这一期是 2026 年 9 月补写的。本站的 AI 日报从 2026 年 8 月 24 日才开始,之前没有记录,就按周往回补,材料是互联网档案馆存下的 GitHub Trending 日榜,每天一份。这一周每天上榜 7 到 14 个仓库,七天加起来 35 个,这里从中挑了 10 个 AI 项目。

名单里有三个项目绕着 OpenAI 的 Codex 转。codex 本身排第三,oh-my-codex 在它外面加了一层工作流,Dimillian/Skills 是一套装进 Codex 的技能。另一处集中在端侧,Google 的 gallery 和 LiteRT-LM 让大模型在手机和边缘设备上跑,mlx-vlm 跑在 Mac 上,4 月 2 日和 3 日这三家先后发版,都接上了 Gemma 4。排第一的 TimesFM 也出自 Google,是 Google Research 的时间序列预测模型。

挑选的条件有三条。AI 得是项目的核心能力,存档页上的 Star 要过 1,000,到周日为止的 90 天里还有提交或发布。资源清单、教程、书的配套代码和提示词合集都不收;前面几周收过的项目,除非这一周发了主版本号升级的新版,也不再收。排序先看这一周上了几天榜,再看单日涨得最多的那天。单日增星是存档那一刻页面上显示的当天数字,每天存档的钟点不一样,只能大致比较。表里的 Star 是这一周最后一次上榜时页面上显示的总数,许可证、发布和提交记录都截至 4 月 5 日。

十个项目

# 项目 上榜 单日最多增星 Star 方向
1 google-research/timesfm 3 天 +1,195(04-02) 13,719(04-03) 时间序列预测模型
2 Yeachan-Heo/oh-my-codex 2 天 +2,867(04-03) 14,819(04-04) Codex 工作流层
3 openai/codex 2 天 +2,345(04-01) 72,361(04-02) 终端编码 Agent
4 Blaizzy/mlx-vlm 2 天 +499(04-04) 3,775(04-05) Mac 视觉模型推理
5 vas3k/TaxHacker 1 天 +810(03-31) 3,495(03-31) 自托管 AI 记账
6 PaddlePaddle/PaddleOCR 1 天 +440(03-31) 73,860(03-31) OCR 与文档解析
7 google-ai-edge/gallery 1 天 +286(04-05) 16,418(04-05) 手机离线跑大模型
8 Dimillian/Skills 1 天 +173(03-31) 2,683(03-31) Codex 技能合集
9 google-ai-edge/LiteRT-LM 1 天 +113(04-05) 1,317(04-05) 端侧大模型推理
10 microsoft/agent-framework 1 天 +66(04-04) 8,508(04-04) 多 Agent 开发框架

逐个看

1. google-research/timesfm

TimesFM 是 Google Research 预训练的时间序列基础模型,专门做预测,论文发在 ICML 2024。当时最新的是 2025 年 9 月放出的 TimesFM 2.5。README 列了它比 2.0 改了什么,参数从 500M 减到 200M,上下文从 2048 放宽到 16k,还可以挂一个 30M 的分位数头,连续预测分位数,最远 1k 步。README 也写明,Google 官方支持的是 BigQuery 里的 TimesFM,这个开源版本不算正式产品。

这一周仓库只有三次提交,都在改 README。4 月 1 日补上一条记在 3 月 19 日的更新,宣布仓库里有了给 Agent 用的 SKILL.md,4 月 3 日又改了两回措辞,加上 AGENTS.md 的链接。这个技能叫 timesfm-forecasting,按它的写法,Agent 第一次加载模型之前必须先跑一个检查脚本,看内存、显存和磁盘够不够。GitHub 上最近的正式发布还是 2024 年底的 v1.2.6。

2. Yeachan-Heo/oh-my-codex

oh-my-codex 简称 OMX,给 OpenAI 的 Codex CLI 套一层工作流,干活的还是 Codex。README 推荐的主线由四个技能串起来,先用 $deep-interview 把需求问清楚,再用 $ralplan 定计划、审取舍,最后在 $team 和 $ralph 之间选一个。$team 借 tmux 和 worktree 让几个 Agent 并行,$ralph 让一个 Agent 一直推到做完。计划、日志和状态都记在项目里的 .omx/ 目录。README 也说得直白,只想用原版 Codex 的人大概用不着它。

仓库 2 月初才建,这一周发了四个补丁版本,4 月 4 日出到 v0.11.13。3 月 30 日它改了 README 和安装时的文案,提交说明写着 Codex CLI 已经去掉 /prompts: 开头的自定义命令,文档于是改成推荐用 $名字 调技能。README 写着用 MIT 许可,仓库里当时却没有 LICENSE 文件。

3. openai/codex

Codex CLI 是 OpenAI 的编码 Agent,README 开头一句就说它在你自己的电脑上本地运行。npm 和 Homebrew 都能装,登录可以走 ChatGPT 账号,Plus、Pro、Team、Edu、Enterprise 这几档订阅都包含它,也可以用 API key。另外还有编辑器插件,以及用 codex app 打开的桌面应用,云端那个叫 Codex Web。许可证是 Apache-2.0。

3 月 31 日发了 rust-v0.118.0。更新日志的新功能里,Windows 沙箱能用系统级的出站规则把网络限制成只走代理,codex exec 也可以一边从管道读输入、一边在命令行里另给提示词。改动清单里还有一条,把剩下的自定义提示词支持整个删掉。正式版发出以后,到 4 月 4 日又接连发了十一个 alpha 预发布。

4. Blaizzy/mlx-vlm

mlx-vlm 用 MLX 在 Mac 上跑视觉语言模型,也能做微调,带音频和视频输入的全模态模型同样支持。它有命令行、Gradio 聊天界面和一个兼容 OpenAI 接口的服务端。README 开头那张模型文档表里,DeepSeek-OCR、GLM-OCR、Falcon-OCR 这类文档识别模型占了将近一半,Gemma 4 也在表上。

这一周发了两版。4 月 2 日那版加上 Gemma 4 的视觉、音频和 MoE 支持,还合进了 TurboQuant,把 KV 缓存从 16 位压到每维 2 到 4 位;README 给的测试里,Qwen3.5-4B 在 128k 上下文下的 KV 缓存从 4.1GB 降到 0.97GB。4 月 4 日的 v0.4.4 修了几处 Gemma 4 的毛病,另外加了图像特征缓存。围着同一张图多轮对话时,视觉编码器只跑一次,README 说提示词处理快了 11 倍以上。

5. vas3k/TaxHacker

TaxHacker 是一个自托管的记账应用,写明给自由职业者、独立开发者和小公司用。拍一张收据或者传一份发票 PDF,它让大模型认出商品、金额、日期、商家和税额,存进一张类似 Excel 的表,想多抽什么信息,可以自己写提示词加字段。外币按交易当天的历史汇率换算,README 说支持 170 多种货币和 14 种加密货币。

这一周它补上了本地模型。3 月 31 日合进一个 PR,加了兼容 OpenAI 接口的模型服务,它也是这天上的日榜。4 月 3 日 README 删掉了 local LLM support coming soon 这句,换成可以接 Ollama、LM Studio、vLLM、LocalAI,同一天发了 v0.7.0,发布说明头一句是 Local LLMs, finally!。README 顺手提醒,本地模型得擅长 OCR,结果不作保证。贡献一节也在这天改了,开头就是 No AI-slop PRs,要改东西先开 Issue 和维护者商量。

6. PaddlePaddle/PaddleOCR

PaddleOCR 是 PaddlePaddle 的 OCR 和文档解析工具包,仓库 2020 年就建了,在这十个里最老。3 月 31 日它重写了 README,开头一句改成把 PDF 和图片转成大模型能直接用的 JSON 或 Markdown,后面列着 Dify、RAGFlow、Cherry Studio 这些用它的项目。主力模型是 1 月 29 日随 v3.4.0 发布的 PaddleOCR-VL-1.5,只有 0.9B 参数,README 说它在 OmniDocBench 上的准确率是 94.5%,新增印章识别,支持的语言扩到 111 种。

这一周它还补了部署。3 月 31 日加了在 AMD 显卡和 Intel Arc 显卡上跑 PaddleOCR-VL 的文档,4 月 2 日又补了这两种硬件的 Docker 镜像。部署目录里原本就有 NVIDIA、Huawei NPU、Hygon DCU 和 Kunlunxin XPU 的配置。

7. google-ai-edge/gallery

Google AI Edge Gallery 是一个手机应用,让开源大模型在手机上离线运行,Android 12 和 iOS 17 以上都能装。应用里分成几块,有多轮聊天、看图问答、录音转写和翻译、能细调参数的 Prompt Lab,还有一个靠微调过的 FunctionGemma 270m 离线操作手机的 Mobile Actions。模型可以从列表里下载,也能导入自己的,再在本机跑基准测试。README 标明这还是实验性的 Beta 版。

4 月 2 日发的 1.0.11 带来了 Gemma 4,聊天加了思考模式,目前只对 Gemma 4 等受支持的模型开放,再就是 Agent Skills。技能目录也是这天才进的仓库,每个技能用一份 SKILL.md 描述。目录里的说明交代了原因。手机上的模型没法随便执行命令和脚本,技能逻辑就放进一个隐藏的 webview,用 JavaScript 跑,或者调用系统自带的能力,比如发邮件。当时内置了 8 个技能,另有 3 个社区精选。

8. Dimillian/Skills

这个仓库在日榜上的简介只有一句 My Codex Skills,用法是把技能文件夹放进 $CODEX_HOME/skills。当时有 16 个技能,一多半和苹果平台开发有关,生成 App Store 更新说明、用 XcodeBuildMCP 在模拟器里调试 iOS 应用、处理 Swift 6.2 以上的并发问题、按 iOS 26 的 Liquid Glass 接口改 SwiftUI 界面,各有一个。剩下的里面有管 GitHub 操作和代码审查的,还有一个专门翻看过去的 Codex 会话,建议项目该补哪些技能。

上榜前两天,作者 Thomas Ricouard 加了两个多 Agent 技能。review-swarm 让四个只读的子 Agent 并行审同一份 diff,分别找行为回归、安全和隐私风险、性能和可靠性问题、接口契约和测试缺口,再由主 Agent 筛掉噪音、排好先后。bug-hunt-swarm 同样派四个只读子 Agent 去查 bug,最后交出排好序的根因。3 月 28 日还有一次提交,专门把审查用的子 Agent 改成只读。这一周仓库没有新提交。

9. google-ai-edge/LiteRT-LM

LiteRT-LM 是 Google 开源的端侧大模型推理框架,README 自称已能用于生产,还说 Chrome、Chromebook Plus 和 Pixel Watch 上的端侧生成式 AI 用的就是它。它覆盖 Android、iOS、Web、桌面和树莓派这类物联网设备,能用 GPU 和 NPU 加速,接受图像和音频输入,也支持函数调用。Kotlin、Python、C++ 三套接口已经稳定,Swift 还在开发。

4 月 2 日仓库合进 Gemma 4 支持,README 顶上换成 Gemma 4 的公告,附了在 Linux、macOS、Windows 的 WSL 和树莓派上用命令行跑 Gemma 4 E2B 的例子。第二天发了 v0.10.1。这一周的提交里不少在改命令行工具,底层从 fire 换成 click,加了投机解码的开关,模型也能直接从 Hugging Face 导入。

10. microsoft/agent-framework

agent-framework 是微软的 Agent 开发框架,Python 和 .NET 两套实现,接口保持一致,简单的聊天 Agent 和按图编排的多 Agent 工作流都能写。工作流支持流式输出、检查点、人工介入和回溯,另有调试用的 DevUI,内置 OpenTelemetry 追踪。README 专门放了从 Semantic Kernel 和 AutoGen 迁移过来的指南。

4 月 2 日,Python 和 .NET 两边同一天发了 1.0.0。Python 的发布说明写着,核心包和 OpenAI、Foundry 两个接入包从 1.0.0rc6 升成正式版,Anthropic、Ollama、A2A 和编排包在内的另外 21 个包仍是 beta,安装说明也去掉了 --pre。.NET 那边的 1.0.0 把 Handoff 编排标成了实验性。按我的理解,1.0 先稳住的是单个 Agent 和主要的模型接入,多 Agent 编排还在变。

几条线索

Codex 周边的三个项目这一周能对上。codex 3 月 31 日的 0.118.0 删掉了剩下的自定义提示词支持,oh-my-codex 早一天就把文档改成用 $名字 调技能,Dimillian/Skills 本来就是一组放进 $CODEX_HOME/skills 的技能文件夹。按我的理解,要给 Codex 加一套固定的做事流程,现在的写法就是技能。

Gemma 4 在两天里进了三个端侧项目。mlx-vlm 和 gallery 4 月 2 日发版,LiteRT-LM 第二天跟上。gallery 的 README 写着它跑模型靠的是 LiteRT,4 月 2 日它还有一条提交专门升级了 litertlm 的版本。三家管的设备各不相同,gallery 在手机上,LiteRT-LM 面向从手表到树莓派的边缘设备,mlx-vlm 主要面向 Mac。

SKILL.md 这一周也出现在编码 Agent 以外的地方。gallery 让手机上的模型按 SKILL.md 调技能,逻辑放在 webview 里跑;TimesFM 给自己的预测模型写了一份,AGENTS.md 里教人把它复制进 Claude Code 或 Cursor 的 skills 目录。按我的理解,项目方开始自己写技能文件,告诉 Agent 怎么用自家的东西。

来源

互联网档案馆存下的 GitHub Trending 日榜,每天一份。

各项目的许可证、发布、提交和 README 内容,取自 GitHub 上对应仓库截至 2026 年 4 月 5 日的历史记录。