这一期是 2026 年 9 月补写的。本站的 AI 日报从 2026 年 8 月 24 日才开始,之前没有记录,就按周往回补,材料是互联网档案馆存下的 GitHub Trending 日榜,每天一份。这一周每天上榜 14 到 19 个仓库,七天加起来 47 个,这里从中挑了 10 个 AI 项目。

排在最前面的 taste-skill 和 stop-slop 都是去 AI 味的技能,一个管前端界面,一个管文字。插件这一周也多,Anthropic 的 knowledge-work-plugins、Cursor 官方的插件仓库和给 Claude Code 生成 Agent 团队的 harness 都在名单里。liteparse 和 crawl4ai 负责把 PDF 和网页变成大模型读得进去的文本。stable-worldmodel 和 Biohub 的 esm 都把自己叫作世界模型,说的却是两回事,前者是在控制任务和游戏环境里用模型预测控制做评测的研究平台,后者是一套蛋白质模型。

挑选的条件有三条。AI 得是项目的核心能力,存档页上的 Star 要过 1,000,到周日为止的 90 天里还有提交或发布。资源清单、教程、书的配套代码和提示词合集都不收;前面几周收过的项目,除非这一周发了主版本号升级的新版,也不再收。排序先看这一周上了几天榜,再看单日涨得最多的那天。单日增星是存档那一刻页面上显示的当天数字,每天存档的钟点不一样,只能大致比较。表里的 Star 是这一周最后一次上榜时页面上显示的总数,许可证、发布和提交记录都截至 5 月 31 日。

十个项目

# 项目 上榜 单日最多增星 Star 方向
1 Leonxlnx/taste-skill 6 天 +2,235(05-28) 28,756(05-30) 前端设计技能
2 hardikpandya/stop-slop 6 天 +755(05-28) 7,215(05-30) 去 AI 腔写作技能
3 anthropics/knowledge-work-plugins 3 天 +1,718(05-27) 16,981(05-27) 岗位插件合集
4 run-llama/liteparse 3 天 +932(05-29) 8,109(05-31) 本地文档解析
5 galilai-group/stable-worldmodel 3 天 +362(05-30) 1,525(05-31) 世界模型研究平台
6 cursor/plugins 3 天 +205(05-31) 1,542(05-31) Cursor 官方插件
7 Biohub/esm 2 天 +102(05-29) 2,596(05-30) 蛋白质模型
8 revfactory/harness 2 天 +68(05-28) 4,395(05-31) Agent 团队生成
9 OpenMOSS/MOSS-TTS 2 天 +62(05-31) 2,731(05-31) 语音与音效生成
10 unclecode/crawl4ai 1 天 +210(05-28) 66,692(05-28) 网页转 Markdown

逐个看

1. Leonxlnx/taste-skill

Taste Skill 是一组给 AI Agent 用的前端设计技能,README 给它的定位是去 AI 味的前端框架。它想让 Agent 做出来的界面在布局、字体、动效和留白上不再一个模样。默认技能先读需求、推断设计语言,再调三个 1 到 10 的旋钮,分管版式变化、动效强度和信息密度。另有极简、粗野主义、柔和高级感几种风格技能,还有只出参考图的生成技能,图可以先交给 ChatGPT Images 画,再拿给 Codex、Cursor 或 Claude Code 照着写。

25 日,默认技能换成了大改过的 v2,README 标为实验版,原来的 v1 另存一份。v2 明令禁用破折号。同一天的一次提交把技能文件里的破折号删到只剩 6 处,都是规则本身要引用的。26 日又根据几轮测试连做了两次加固。许可证是 MIT。

2. hardikpandya/stop-slop

stop-slop 是一个单独的技能,教 Claude 或别的大模型找出并删掉文字里的 AI 痕迹。核心规则在 SKILL.md 里,词句清单、句式清单和改写前后的对照各放一份参考文件。README 点名要删的有清嗓子式的开头、拿来强调的拐杖词、商业黑话和所有副词。句式上要躲开二元对比、戏剧化碎句和被动语态,句子层面不许用破折号,也不许拿 Wh 开头的词起句。改完按直接、节奏、信任、真实、密度五项各打 1 到 10 分,总分低于 35 就要重写。

仓库最后一次提交还是 3 月 17 日,这一周没有任何改动,接入方式也简单,Claude Code 里把整个文件夹加成技能就行,调 API 时把 SKILL.md 放进系统提示词。许可证是 MIT。

3. anthropics/knowledge-work-plugins

这是 Anthropic 开源的岗位插件合集,主要为 Claude Cowork 做,也能在 Claude Code 里装。每个插件对应一种岗位,把技能、连外部工具的 MCP 配置、斜杠命令和子 Agent 打成一包,比如销售插件能查潜在客户、准备通话、起草开发信,法务插件管审合同和分拣保密协议。README 强调所有组件都是 Markdown 和 JSON,没有代码,也不用搭基础设施,企业可以把自己的工具、术语和流程直接改进去。

README 的表格列的是 Anthropic 自己做的 11 个插件。这一周的提交又加进了 Carta、Airtable、Twilio、ServiceNow 等公司产品的插件,插件市场的清单到周日一共有 58 个。许可证是 Apache-2.0。

4. run-llama/liteparse

LiteParse 是 LlamaIndex 团队开源的本地 PDF 解析工具,只求快和轻,不带大模型功能,也不依赖云服务。它用 PDFium 抽取带坐标的文字,内置 Tesseract 做 OCR,也能接 EasyOCR、PaddleOCR 这类 HTTP 服务。Word、Excel、PPT 和图片先经 LibreOffice 或 ImageMagick 转换再解析,每页还能截图,给 Agent 看文字表达不了的内容。核心用 Rust 写,Node、Python 和浏览器里的 WASM 都能调。

25 日发了 2.0.0,Rust crate、Python、Node、WASM 和 Docker 五个包同一天发布,到 30 日修到 wasm-v2.0.4,1.x 的旧代码留在另一个分支。README 也写明了边界,遇到密集表格、多栏排版、图表、手写和扫描件,推荐改用自家的云端服务 LlamaParse。许可证是 Apache-2.0。

5. galilai-group/stable-worldmodel

stable-worldmodel 想给世界模型研究一套统一的平台,收集数据、训练、用模型预测控制做评测,三个阶段走同一个接口。环境来自 DeepMind Control Suite、Gymnasium、OGBench、Craftax 和 100 多个 Atari 游戏,大多带可以单独调节的光照、纹理、动力学等变化因素,用来测零样本泛化。规划求解器有 CEM、MPPI 等七种,基线里有 DINO-WM、LeWM 这些 JEPA 类模型。数据默认存成 LanceDB,README 的测试里,本地读取每秒 4814.8 个样本,HDF5 是 1416.1 个。

26 日发了 0.1.0,上一个正式版还是 2 月的 0.0.5,README 提醒库还在活跃开发,小版本之间接口可能会变。配套论文的作者里有 Yann LeCun 和 Randall Balestriero。

6. cursor/plugins

这是 Cursor 官方的插件仓库,每个插件一个目录,里面可以放 SKILL.md 技能、Cursor 规则文件和 MCP 服务配置。README 的表里列了 11 个,除了一个出自 Lauren Tan,都是 Cursor 自己做的。continual-learning 把会话记录里的要点增量写进 AGENTS.md,orchestrate 把大任务拆给多个云端 Agent 并行做。cursor-team-kit 收的是 Cursor 开发者内部用的 CI、代码审查和发版流程,另有一个 cli-for-agent,专讲怎么设计让编码 Agent 跑得稳的命令行。

这一周 30 次提交,大半在改 Lauren Tan 的 pstack,版本从 0.2.0 一路升到 0.6.0。28 日加了做深度分支审查的 Thermos,同一天加进来的 founder-gtm 当天又撤掉了。仓库根目录没有许可证文件,各插件目录各带一份 LICENSE,README 末尾写着 MIT。

7. Biohub/esm

esm 是 Biohub 的蛋白质模型仓库,README 标题把这套东西叫作蛋白质生物学的世界模型。打底的是 ESMC,一个在数十亿条蛋白质序列上训练的语言模型。建在 60 亿参数 ESMC 之上的 ESMFold2 用扩散模型预测全原子三维结构,README 说效果追平或超过 AlphaFold3,还在实验室里对五个治疗靶点做过验证。第三样是 ESM Atlas,一张 68 亿个蛋白质的图谱,配套的稀疏自编码器把 ESMC 的内部表示拆成约 16,000 个可解释特征,再由 Agent 流程给每个特征写说明。

27 日有一次提交专门为 ESMC 论文更新仓库。README 有一节讲前沿安全,说发布前做过生物安全评估,网页平台会拦下与受管控病原体和毒素相关的关键词和序列。许可证是 MIT,版权方是 Chan Zuckerberg Biohub。

8. revfactory/harness

Harness 是一个 Claude Code 插件,对它说一句给这个项目搭个 harness,它就按你描述的领域生成一支 Agent 团队和团队要用的技能,写进 .claude/agents/ 和 .claude/skills/。团队结构从六种预设里挑,有流水线、扇出扇入、专家池、生产加审核、主管调度和层级委派。它依赖 Claude Code 实验性的 Agent Teams 功能,要先设环境变量打开。README 列了一组作者自测的数字,15 个软件工程任务上平均质量分从 49.5 升到 79.3,同一段写明样本只有 15 个、是作者自己测的、还没有第三方复现,FAQ 里还自问这个提升是不是吹过了头。

这一周的提交主要在改 README 和插件市场配置,29 日合进了一份复用已有技能的指南。许可证是 Apache-2.0。

9. OpenMOSS/MOSS-TTS

MOSS-TTS 是 MOSI.AI 和 OpenMOSS 团队开源的语音与音效生成模型家族,一共五个模型。旗舰的 MOSS-TTS 做零样本声音克隆和长语音,能细控拼音、音素和时长,另外四个分管多人对话、按文字描述设计音色、实时语音和音效。README 说实时版的首字节延迟是 180 毫秒,对话模型在主观评测里胜过豆包和 Gemini 2.5 Pro 这类闭源模型。

26 日它发了两个新模型。MOSS-TTS-v1.5 把支持的语言扩到 31 种,克隆更稳,还能用 [pause X.Ys] 指定停顿;MOSS-SoundEffect-v2.0 用 DiT 骨干加流匹配,能生成最长 30 秒、48 kHz 的双语音效。许可证是 Apache-2.0。

10. unclecode/crawl4ai

Crawl4AI 把网页转成干净的 Markdown,给 RAG、Agent 和数据管道用,除了 Python 库还有命令行,可以深度爬取,也能带着一个问题让大模型抽取内容。README 里作者讲了来历,2023 年他要把网页转成 Markdown,号称开源的方案却要注册账号、要 API token、还收 16 美元,他就几天里自己写了一个。

README 顶上推的是 v0.8.6,说原版 litellm 在 PyPI 上遭遇供应链攻击,依赖换成了 unclecode-litellm,还在用 v0.8.5 的要马上升级。GitHub 上的正式发布却停在 3 月的 v0.8.5,v0.8.6 只打了标签。这一周合进的几个修复里,有一个解决 MCP 输出中日韩文字的编码问题。许可证是 Apache-2.0,README 一处说建议署名,下一节又写成必须署名。

几条线索

排在最前的两个项目,对 AI 味的定义有重叠。stop-slop 在句子层面禁用破折号,taste-skill 的 v2 也明令禁用,25 日的提交还把技能文件里的破折号清到只剩规则引用。两者的做法也像,stop-slop 给文字按五项打分,taste-skill 给界面调三个旋钮,我觉得两者都在把说不清的品味拆成能逐条检查的规则。

Anthropic 和 Cursor 的插件长得很像。knowledge-work-plugins 一个插件一个目录,放 .claude-plugin/plugin.json 清单、.mcp.json 和 commands、skills 两个文件夹;cursor/plugins 也是一个插件一个目录,放 .cursor-plugin/plugin.json、SKILL.md 技能和 MCP 配置,多一个装 Cursor 规则的 rules。harness 同样以 .claude-plugin/plugin.json 加技能目录的形式分发。按我的理解,三家插件的主体都是 Markdown 和 JSON 文件,差别主要在清单放在哪个目录。

给大模型准备材料的两个工具,都在开源版旁边留了一个云服务。liteparse 遇到复杂文档就推荐自家的 LlamaParse,crawl4ai 的 README 顶上在招云端 API 的内测用户,说那套服务做大规模抓取会便宜得多。

来源

互联网档案馆存下的 GitHub Trending 日榜,每天一份。

各项目的许可证、发布、提交和 README 内容,取自 GitHub 上对应仓库截至 2026 年 5 月 31 日的历史记录。