---
title: "GitHub AI 项目回溯周报｜2026-05-25 至 2026-05-31"
description: "5 月最后一周，两个去 AI 味的技能排在最前，Anthropic 和 Cursor 的插件合集也都上了榜。本期依据互联网档案馆存下的日榜补写。"
pubDate: 2026-05-31
tags: ["GitHub AI 日报", "回溯周报", "Agent Skills", "Claude Code", "文档解析"]
---

这一期是 2026 年 9 月补写的。本站的 AI 日报从 2026 年 8 月 24 日才开始，之前没有记录，就按周往回补，材料是互联网档案馆存下的 GitHub Trending 日榜，每天一份。这一周每天上榜 14 到 19 个仓库，七天加起来 47 个，这里从中挑了 10 个 AI 项目。

排在最前面的 taste-skill 和 stop-slop 都是去 AI 味的技能，一个管前端界面，一个管文字。插件这一周也多，Anthropic 的 knowledge-work-plugins、Cursor 官方的插件仓库和给 Claude Code 生成 Agent 团队的 harness 都在名单里。liteparse 和 crawl4ai 负责把 PDF 和网页变成大模型读得进去的文本。stable-worldmodel 和 Biohub 的 esm 都把自己叫作世界模型，说的却是两回事，前者是在控制任务和游戏环境里用模型预测控制做评测的研究平台，后者是一套蛋白质模型。

挑选的条件有三条。AI 得是项目的核心能力，存档页上的 Star 要过 1,000，到周日为止的 90 天里还有提交或发布。资源清单、教程、书的配套代码和提示词合集都不收；前面几周收过的项目，除非这一周发了主版本号升级的新版，也不再收。排序先看这一周上了几天榜，再看单日涨得最多的那天。单日增星是存档那一刻页面上显示的当天数字，每天存档的钟点不一样，只能大致比较。表里的 Star 是这一周最后一次上榜时页面上显示的总数，许可证、发布和提交记录都截至 5 月 31 日。

## 十个项目

| # | 项目 | 上榜 | 单日最多增星 | Star | 方向 |
|---|---|---|---|---|---|
| 1 | [Leonxlnx/taste-skill](https://github.com/Leonxlnx/taste-skill) | 6 天 | +2,235（05-28） | 28,756（05-30） | 前端设计技能 |
| 2 | [hardikpandya/stop-slop](https://github.com/hardikpandya/stop-slop) | 6 天 | +755（05-28） | 7,215（05-30） | 去 AI 腔写作技能 |
| 3 | [anthropics/knowledge-work-plugins](https://github.com/anthropics/knowledge-work-plugins) | 3 天 | +1,718（05-27） | 16,981（05-27） | 岗位插件合集 |
| 4 | [run-llama/liteparse](https://github.com/run-llama/liteparse) | 3 天 | +932（05-29） | 8,109（05-31） | 本地文档解析 |
| 5 | [galilai-group/stable-worldmodel](https://github.com/galilai-group/stable-worldmodel) | 3 天 | +362（05-30） | 1,525（05-31） | 世界模型研究平台 |
| 6 | [cursor/plugins](https://github.com/cursor/plugins) | 3 天 | +205（05-31） | 1,542（05-31） | Cursor 官方插件 |
| 7 | [Biohub/esm](https://github.com/Biohub/esm) | 2 天 | +102（05-29） | 2,596（05-30） | 蛋白质模型 |
| 8 | [revfactory/harness](https://github.com/revfactory/harness) | 2 天 | +68（05-28） | 4,395（05-31） | Agent 团队生成 |
| 9 | [OpenMOSS/MOSS-TTS](https://github.com/OpenMOSS/MOSS-TTS) | 2 天 | +62（05-31） | 2,731（05-31） | 语音与音效生成 |
| 10 | [unclecode/crawl4ai](https://github.com/unclecode/crawl4ai) | 1 天 | +210（05-28） | 66,692（05-28） | 网页转 Markdown |

## 逐个看

### 1. [Leonxlnx/taste-skill](https://github.com/Leonxlnx/taste-skill)

Taste Skill 是一组给 AI Agent 用的前端设计技能，README 给它的定位是去 AI 味的前端框架。它想让 Agent 做出来的界面在布局、字体、动效和留白上不再一个模样。默认技能先读需求、推断设计语言，再调三个 1 到 10 的旋钮，分管版式变化、动效强度和信息密度。另有极简、粗野主义、柔和高级感几种风格技能，还有只出参考图的生成技能，图可以先交给 ChatGPT Images 画，再拿给 Codex、Cursor 或 Claude Code 照着写。

25 日，默认技能换成了大改过的 v2，README 标为实验版，原来的 v1 另存一份。v2 明令禁用破折号。同一天的一次提交把技能文件里的破折号删到只剩 6 处，都是规则本身要引用的。26 日又根据几轮测试连做了两次加固。许可证是 MIT。

### 2. [hardikpandya/stop-slop](https://github.com/hardikpandya/stop-slop)

stop-slop 是一个单独的技能，教 Claude 或别的大模型找出并删掉文字里的 AI 痕迹。核心规则在 SKILL.md 里，词句清单、句式清单和改写前后的对照各放一份参考文件。README 点名要删的有清嗓子式的开头、拿来强调的拐杖词、商业黑话和所有副词。句式上要躲开二元对比、戏剧化碎句和被动语态，句子层面不许用破折号，也不许拿 Wh 开头的词起句。改完按直接、节奏、信任、真实、密度五项各打 1 到 10 分，总分低于 35 就要重写。

仓库最后一次提交还是 3 月 17 日，这一周没有任何改动，接入方式也简单，Claude Code 里把整个文件夹加成技能就行，调 API 时把 SKILL.md 放进系统提示词。许可证是 MIT。

### 3. [anthropics/knowledge-work-plugins](https://github.com/anthropics/knowledge-work-plugins)

这是 Anthropic 开源的岗位插件合集，主要为 Claude Cowork 做，也能在 Claude Code 里装。每个插件对应一种岗位，把技能、连外部工具的 MCP 配置、斜杠命令和子 Agent 打成一包，比如销售插件能查潜在客户、准备通话、起草开发信，法务插件管审合同和分拣保密协议。README 强调所有组件都是 Markdown 和 JSON，没有代码，也不用搭基础设施，企业可以把自己的工具、术语和流程直接改进去。

README 的表格列的是 Anthropic 自己做的 11 个插件。这一周的提交又加进了 Carta、Airtable、Twilio、ServiceNow 等公司产品的插件，插件市场的清单到周日一共有 58 个。许可证是 Apache-2.0。

### 4. [run-llama/liteparse](https://github.com/run-llama/liteparse)

LiteParse 是 LlamaIndex 团队开源的本地 PDF 解析工具，只求快和轻，不带大模型功能，也不依赖云服务。它用 PDFium 抽取带坐标的文字，内置 Tesseract 做 OCR，也能接 EasyOCR、PaddleOCR 这类 HTTP 服务。Word、Excel、PPT 和图片先经 LibreOffice 或 ImageMagick 转换再解析，每页还能截图，给 Agent 看文字表达不了的内容。核心用 Rust 写，Node、Python 和浏览器里的 WASM 都能调。

25 日发了 2.0.0，Rust crate、Python、Node、WASM 和 Docker 五个包同一天发布，到 30 日修到 wasm-v2.0.4，1.x 的旧代码留在另一个分支。README 也写明了边界，遇到密集表格、多栏排版、图表、手写和扫描件，推荐改用自家的云端服务 LlamaParse。许可证是 Apache-2.0。

### 5. [galilai-group/stable-worldmodel](https://github.com/galilai-group/stable-worldmodel)

stable-worldmodel 想给世界模型研究一套统一的平台，收集数据、训练、用模型预测控制做评测，三个阶段走同一个接口。环境来自 DeepMind Control Suite、Gymnasium、OGBench、Craftax 和 100 多个 Atari 游戏，大多带可以单独调节的光照、纹理、动力学等变化因素，用来测零样本泛化。规划求解器有 CEM、MPPI 等七种，基线里有 DINO-WM、LeWM 这些 JEPA 类模型。数据默认存成 LanceDB，README 的测试里，本地读取每秒 4814.8 个样本，HDF5 是 1416.1 个。

26 日发了 0.1.0，上一个正式版还是 2 月的 0.0.5，README 提醒库还在活跃开发，小版本之间接口可能会变。配套论文的作者里有 Yann LeCun 和 Randall Balestriero。

### 6. [cursor/plugins](https://github.com/cursor/plugins)

这是 Cursor 官方的插件仓库，每个插件一个目录，里面可以放 SKILL.md 技能、Cursor 规则文件和 MCP 服务配置。README 的表里列了 11 个，除了一个出自 Lauren Tan，都是 Cursor 自己做的。continual-learning 把会话记录里的要点增量写进 AGENTS.md，orchestrate 把大任务拆给多个云端 Agent 并行做。cursor-team-kit 收的是 Cursor 开发者内部用的 CI、代码审查和发版流程，另有一个 cli-for-agent，专讲怎么设计让编码 Agent 跑得稳的命令行。

这一周 30 次提交，大半在改 Lauren Tan 的 pstack，版本从 0.2.0 一路升到 0.6.0。28 日加了做深度分支审查的 Thermos，同一天加进来的 founder-gtm 当天又撤掉了。仓库根目录没有许可证文件，各插件目录各带一份 LICENSE，README 末尾写着 MIT。

### 7. [Biohub/esm](https://github.com/Biohub/esm)

esm 是 Biohub 的蛋白质模型仓库，README 标题把这套东西叫作蛋白质生物学的世界模型。打底的是 ESMC，一个在数十亿条蛋白质序列上训练的语言模型。建在 60 亿参数 ESMC 之上的 ESMFold2 用扩散模型预测全原子三维结构，README 说效果追平或超过 AlphaFold3，还在实验室里对五个治疗靶点做过验证。第三样是 ESM Atlas，一张 68 亿个蛋白质的图谱，配套的稀疏自编码器把 ESMC 的内部表示拆成约 16,000 个可解释特征，再由 Agent 流程给每个特征写说明。

27 日有一次提交专门为 ESMC 论文更新仓库。README 有一节讲前沿安全，说发布前做过生物安全评估，网页平台会拦下与受管控病原体和毒素相关的关键词和序列。许可证是 MIT，版权方是 Chan Zuckerberg Biohub。

### 8. [revfactory/harness](https://github.com/revfactory/harness)

Harness 是一个 Claude Code 插件，对它说一句给这个项目搭个 harness，它就按你描述的领域生成一支 Agent 团队和团队要用的技能，写进 `.claude/agents/` 和 `.claude/skills/`。团队结构从六种预设里挑，有流水线、扇出扇入、专家池、生产加审核、主管调度和层级委派。它依赖 Claude Code 实验性的 Agent Teams 功能，要先设环境变量打开。README 列了一组作者自测的数字，15 个软件工程任务上平均质量分从 49.5 升到 79.3，同一段写明样本只有 15 个、是作者自己测的、还没有第三方复现，FAQ 里还自问这个提升是不是吹过了头。

这一周的提交主要在改 README 和插件市场配置，29 日合进了一份复用已有技能的指南。许可证是 Apache-2.0。

### 9. [OpenMOSS/MOSS-TTS](https://github.com/OpenMOSS/MOSS-TTS)

MOSS-TTS 是 MOSI.AI 和 OpenMOSS 团队开源的语音与音效生成模型家族，一共五个模型。旗舰的 MOSS-TTS 做零样本声音克隆和长语音，能细控拼音、音素和时长，另外四个分管多人对话、按文字描述设计音色、实时语音和音效。README 说实时版的首字节延迟是 180 毫秒，对话模型在主观评测里胜过豆包和 Gemini 2.5 Pro 这类闭源模型。

26 日它发了两个新模型。MOSS-TTS-v1.5 把支持的语言扩到 31 种，克隆更稳，还能用 `[pause X.Ys]` 指定停顿；MOSS-SoundEffect-v2.0 用 DiT 骨干加流匹配，能生成最长 30 秒、48 kHz 的双语音效。许可证是 Apache-2.0。

### 10. [unclecode/crawl4ai](https://github.com/unclecode/crawl4ai)

Crawl4AI 把网页转成干净的 Markdown，给 RAG、Agent 和数据管道用，除了 Python 库还有命令行，可以深度爬取，也能带着一个问题让大模型抽取内容。README 里作者讲了来历，2023 年他要把网页转成 Markdown，号称开源的方案却要注册账号、要 API token、还收 16 美元，他就几天里自己写了一个。

README 顶上推的是 v0.8.6，说原版 litellm 在 PyPI 上遭遇供应链攻击，依赖换成了 unclecode-litellm，还在用 v0.8.5 的要马上升级。GitHub 上的正式发布却停在 3 月的 v0.8.5，v0.8.6 只打了标签。这一周合进的几个修复里，有一个解决 MCP 输出中日韩文字的编码问题。许可证是 Apache-2.0，README 一处说建议署名，下一节又写成必须署名。

## 几条线索

排在最前的两个项目，对 AI 味的定义有重叠。stop-slop 在句子层面禁用破折号，taste-skill 的 v2 也明令禁用，25 日的提交还把技能文件里的破折号清到只剩规则引用。两者的做法也像，stop-slop 给文字按五项打分，taste-skill 给界面调三个旋钮，我觉得两者都在把说不清的品味拆成能逐条检查的规则。

Anthropic 和 Cursor 的插件长得很像。knowledge-work-plugins 一个插件一个目录，放 `.claude-plugin/plugin.json` 清单、`.mcp.json` 和 commands、skills 两个文件夹；cursor/plugins 也是一个插件一个目录，放 `.cursor-plugin/plugin.json`、SKILL.md 技能和 MCP 配置，多一个装 Cursor 规则的 rules。harness 同样以 `.claude-plugin/plugin.json` 加技能目录的形式分发。按我的理解，三家插件的主体都是 Markdown 和 JSON 文件，差别主要在清单放在哪个目录。

给大模型准备材料的两个工具，都在开源版旁边留了一个云服务。liteparse 遇到复杂文档就推荐自家的 LlamaParse，crawl4ai 的 README 顶上在招云端 API 的内测用户，说那套服务做大规模抓取会便宜得多。

## 来源

互联网档案馆存下的 GitHub Trending 日榜，每天一份。

- [5 月 25 日](https://web.archive.org/web/20260525124435/https://github.com/trending)
- [5 月 26 日](https://web.archive.org/web/20260526125733/https://github.com/trending)
- [5 月 27 日](https://web.archive.org/web/20260527120609/https://github.com/trending)
- [5 月 28 日](https://web.archive.org/web/20260528122011/https://github.com/trending)
- [5 月 29 日](https://web.archive.org/web/20260529125118/https://github.com/trending)
- [5 月 30 日](https://web.archive.org/web/20260530120623/https://github.com/trending)
- [5 月 31 日](https://web.archive.org/web/20260531103042/https://github.com/trending)

各项目的许可证、发布、提交和 README 内容，取自 GitHub 上对应仓库截至 2026 年 5 月 31 日的历史记录。
