这一期是 2026 年 9 月补写的。本站的 AI 日报从 2026 年 8 月 24 日才开始,之前没有记录,就按周往回补,材料是互联网档案馆存下的 GitHub Trending 日榜,每天一份。这一周每天上榜 10 到 14 个仓库,七天加起来 45 个,这里从中挑了 10 个 AI 项目。
名单里好几个项目和 Claude Code 连在一起。Claude Code 自己排第二;claude-mem 是它的记忆插件,superpowers 借它的插件市场分发技能,chrome-devtools-mcp 把一个能调试的 Chrome 交给它这类编码 Agent。另一处热闹在 Agent 的记忆,memU、claude-mem、memvid 做的都是这件事,三家还都在这一周的头两天升了主版本号。
挑选的条件有三条。AI 得是项目的核心能力,存档页上的 Star 要过 1,000,到周日为止的 90 天里还有提交或发布。资源清单、教程、书的配套代码和提示词合集都不收;前面几周收过的项目,除非这一周发了主版本号升级的新版,也不再收。排序先看这一周上了几天榜,再看单日涨得最多的那天。单日增星是存档那一刻页面上显示的当天数字,每天存档的钟点不一样,只能大致比较。表里的 Star 是这一周最后一次上榜时页面上显示的总数,许可证、发布和提交记录都截至 1 月 11 日。
十个项目
| # | 项目 | 上榜 | 单日最多增星 | Star | 方向 |
|---|---|---|---|---|---|
| 1 | MiroMindAI/MiroThinker | 5 天 | +799(01-08) | 4,351(01-11) | 搜索 Agent 模型 |
| 2 | anthropics/claude-code | 5 天 | +779(01-09) | 54,963(01-11) | 终端编码 Agent |
| 3 | ChromeDevTools/chrome-devtools-mcp | 5 天 | +427(01-09) | 20,196(01-11) | 浏览器调试 MCP |
| 4 | bytedance/UI-TARS-desktop | 3 天 | +831(01-09) | 22,533(01-11) | 多模态 GUI Agent |
| 5 | NevaMind-AI/memU | 3 天 | +97(01-08) | 4,376(01-11) | Agent 记忆框架 |
| 6 | thedotmack/claude-mem | 2 天 | +803(01-08) | 12,289(01-08) | Claude Code 记忆插件 |
| 7 | obra/superpowers | 2 天 | +777(01-11) | 16,415(01-11) | 编码 Agent 技能流程 |
| 8 | memvid/memvid | 2 天 | +465(01-08) | 11,615(01-08) | 单文件 Agent 记忆 |
| 9 | Lightricks/ComfyUI-LTXVideo | 2 天 | +159(01-09) | 2,730(01-09) | 视频生成节点 |
| 10 | hacksider/Deep-Live-Cam | 2 天 | +119(01-11) | 77,249(01-11) | 实时换脸 |
逐个看
1. MiroMindAI/MiroThinker
MiroThinker 是 MiroMind 开源的搜索 Agent 模型,专门练的是一边调用工具查资料、一边推理。仓库里除了模型,还有配套的 Agent 框架 MiroFlow、14.7 万条样本的训练数据 MiroVerse 和训练工具。README 的更新记录里,1 月 5 日发布了 MiroThinker-v1.5,分 30B 和 235B 两个尺寸,都从同尺寸的 Qwen3 思考模型训练而来,上下文 256K,一个任务最多调用 400 次工具。
README 说 235B 版在 BrowseComp 上得分 69.8%,30B 版在 BrowseComp-ZH 上超过了 Kimi-K2-Thinking,参数只有对方的 1/30。它把这套训练思路叫 interactive scaling,让模型和环境交互得更深、更频繁,算作模型尺寸和上下文长度之外的第三个方向。v1.5 发出两天后它上了榜,这一周仓库里补了接 LobeChat 的说明,也更新了本地部署用的 Gradio 演示。要自己跑完整流程,还得备好 Serper、Jina、E2B 三家的 API key,搜索、抓网页和代码沙箱都靠它们。
2. anthropics/claude-code
Claude Code 是 Anthropic 的编码 Agent。README 的介绍是它待在终端里,读得懂代码库,能用自然语言跑日常任务、解释代码、处理 git 流程,也能在 IDE 里用,或者在 GitHub 上 @claude 叫它干活。这个仓库放的是更新日志、插件和示例,LICENSE.md 只有一句话,版权归 Anthropic 所有,使用要遵守 Anthropic 的商业服务条款。
1 月 7 日它升到 2.1,更新日志里 2.1.0 这一节有一百多条,其中十二条和技能有关。改过的技能不用重启会话就能生效,技能可以用 context: fork 放进单独的子 Agent 里跑,技能的 frontmatter 里也能挂 hooks。之后几天又陆续发版,1 月 9 日的 2.1.3 把斜杠命令和技能合成了一类,1 月 11 日出到 v2.1.4。1 月 10 日和 11 日两天,它在日榜上排第一。
3. ChromeDevTools/chrome-devtools-mcp
chrome-devtools-mcp 是一个 MCP 服务,让 Gemini、Claude、Cursor、Copilot 这类编码 Agent 控制和检查一个正在运行的 Chrome。README 列了 26 个工具,分输入、导航、模拟、性能、网络、调试六类,点击、填表、截图、读控制台、录性能 trace 都能做,自动化靠的是 puppeteer。README 给 Claude Code、Codex、Gemini CLI、Cursor 等 19 种客户端分别写了配置方法,还提醒用户,MCP 客户端能看到也能改浏览器里的任何数据,不想给它看的东西别放进这个浏览器。
这一周它没有发新版。1 月 5 日 README 加上了 OpenCode 的配置示例,1 月 9 日合进一个实验性的视觉模式,新增隐藏参数 --experimental-vision,打开以后多出一个按坐标点击的 click_at 工具。README 里还写着,从 Chrome 144 开始它能直接连上用户自己开着的 Chrome,当时这个版本还得走 beta 通道。
4. bytedance/UI-TARS-desktop
UI-TARS-desktop 是字节跳动的多模态 Agent 仓库,里面放着两个项目。Agent TARS 是通用的多模态 Agent,主要通过命令行和网页界面来用,操作浏览器时可以按截图做视觉定位,也可以读 DOM,或者两种混用;它的内核建在 MCP 上,还能挂别的 MCP 服务。UI-TARS Desktop 是桌面应用,由 UI-TARS 和 Seed-1.5-VL/1.6 系列模型驱动,看屏幕截图认界面,再动鼠标键盘,本机和远程的电脑、浏览器都能操作。
它在榜上那几天,每天都涨八百多个 Star,仓库这一周却很安静,只有 1 月 5 日一个改错别字的提交。最近的正式发布还是去年 11 月的 v0.3.0,那是 Agent TARS 命令行的版本。README 说这一版给多种工具加了流式输出,能统计工具调用和深度思考的耗时,还支持把工具放进 AIO Agent Sandbox 这个隔离环境里执行。
5. NevaMind-AI/memU
memU 是给大模型和 Agent 后端用的记忆框架。它把对话、文档、图片这些输入抽成结构化的记忆,分三层存放,最底层是原始资料,中间一层是一条条记忆,比如某人的偏好、习惯和观点,最上层按类别汇总成 preferences.md 这样的 Markdown 文件。检索有两种走法,用 embedding 做向量检索,快也便宜;或者直接让大模型去读,慢一些,README 说理解得更深。README 还说它在 Locomo 基准上的平均准确率是 92.09%。
这一周它发版很密,1 月 5 日发了 1.0.0,到 1 月 8 日已经出到 v1.1.2,中间补了 Linux ARM64 的构建和自定义模型服务的配置说明。README 这一周也在拉人气,顶上加了一段请大家点 Star 的动图,还写着 1 月 8 日到 18 日和另外四个开源项目合办 2026 新年挑战,给 memU 提 PR 能拿现金奖励。
6. thedotmack/claude-mem
claude-mem 是 Claude Code 的插件,给它补上跨会话的记忆。它挂在 Claude Code 的 5 个生命周期 hook 上,自动记下 Claude 用工具时的观察,生成摘要存进 SQLite,下次开新会话再把相关内容注入回来。后台有个跑在 37777 端口的服务,带一个能实时看记忆流的网页。查记忆分三步,先用 search 拿一份带编号的索引,再用 timeline 看某条前后发生了什么,最后只对挑中的编号取全文,README 说这样能省下十倍左右的 token。
这一周它从 8.5 升到了 9。1 月 6 日的 9.0.0 叫 Live Context System,会给每个目录自动生成一份 CLAUDE.md,按时间列出这个目录最近的开发活动。1 月 8 日的 9.0.1 修的是和 Claude Code 2.1.1 的兼容问题,这个 Claude Code 版本前一天才发布。1 月 10 日又出了 v9.0.4。
7. obra/superpowers
superpowers 把一整套软件开发流程拆成可以组合的技能,装进编码 Agent。按 README 的描述,Agent 看出你要做东西,先停下来问清楚你到底想做什么,把设计分成几段给你看;你点头以后,它写实施计划,每个任务切成两到五分钟的小块,写明文件路径、完整代码和验证步骤。开工后每个任务派一个新的子 Agent,做完先查是否符合规格,再查代码质量。测试驱动开发是硬规定,测试之前写的代码要删掉。
README 说 Claude 照着计划自己干上一两个小时并不少见。它在 Claude Code 里通过插件市场安装,Codex 和 OpenCode 要手动配置,技能本身都放在这个仓库里,许可证是 MIT。这一周仓库没有新提交,最近一次停在去年 12 月底。
8. memvid/memvid
memvid 把 Agent 的记忆整个装进一个 .mv2 文件,原始数据、embedding、索引和元数据都在里面,不用另外跑向量数据库。README 说它借了视频编码的思路。记忆按只追加的 Smart Frame 一帧帧往后写,能回到过去任一时刻去查,程序崩溃也弄不坏已经提交的帧。文件里自带 BM25 全文索引、HNSW 向量索引和时间索引,README 特意写了一句,没有 .wal、.lock 这类旁路文件。
1 月 5 日发布的 2.0 是一次重写,发布说明写着从 Python 整个改成了 Rust。去年 6 月的 0.1 版,README 标题还是 Video-Based AI Memory,做法是把文本编码进 MP4 视频。这一周最新的发布是 1 月 10 日的 v2.0.133。其余提交多是 README 的各语言译本,另有一组流式加密改动,解决加解密大文件时内存不够的问题。
9. Lightricks/ComfyUI-LTXVideo
这是 Lightricks 给 ComfyUI 做的一组自定义节点,配合自家的视频生成模型 LTX-2 用。LTX-2 已经进了 ComfyUI 核心,这个仓库补的是额外的节点和工作流,示例里有文生视频、图生视频的完整版和蒸馏版,还有视频细化,以及用深度、人体姿态、边缘图控制画面的 IC-LoRA。门槛写得很清楚,要 32GB 显存以上的 CUDA 显卡,磁盘留出 100GB。
仓库是在这一周整个换到 LTX-2 的。1 月 6 日合进一个标题叫 Automated PR 的提交,改了九十多个文件,旧的 13B 模型工作流全部删掉,换上 LTX-2 的工作流和 Gemma 3 文本编码器。许可证也跟着换了,新文件是 LTX-2 Community License Agreement,条款写明年收入一千万美元及以上的使用方要另外买付费的商业许可。
10. hacksider/Deep-Live-Cam
Deep-Live-Cam 只要一张照片就能实时换脸,摄像头画面和视频都能换。README 把用法缩成三步,选一张脸,选摄像头,点 Live。功能里有保留原本嘴部动作的 Mouth Mask,也能给画面里的几个人同时换上不同的脸。仓库 2023 年就建了,在这十个里最老,Star 也最多。
README 开头是一大段免责声明,说程序内置检查,不处理裸露、血腥和战争画面这类内容;用真人的脸要先征得本人同意,发到网上要标明是深度伪造。它用到的 insightface 模型,README 在致谢里提醒只能用于非商业研究,项目自己的许可证是 AGPL-3.0。这一周仓库没有提交,最近一次发布是去年 12 月的 2.4,README 最上面的标题却还写着 2.0.1c。
几条线索
围着 Claude Code 的项目这一周扎堆上榜。claude-mem 挂在 Claude Code 的生命周期 hook 上干活,Claude Code 1 月 7 日发了 2.1.1,claude-mem 第二天就发了 9.0.1 修兼容。superpowers 从 Claude Code 的插件市场安装,靠的是技能机制,而 Claude Code 2.1.0 的一百多条改动里,有十二条和技能有关。宿主一周发了五个版本,插件得跟着它的节奏改。
这一周有三个项目做 Agent 的记忆,都在周一周二升了主版本号。memU 1 月 5 日发 1.0.0,memvid 同一天发了用 Rust 重写的 2.0,claude-mem 1 月 6 日发 9.0.0。三家存记忆的形式各不相同,memU 分三层、顶层是 Markdown 文件,claude-mem 用 SQLite 和 Chroma,memvid 全塞进一个文件。检索上它们都没有只靠向量,memU 可以让大模型直接读记忆,claude-mem 和 memvid 都把关键词检索和向量检索混着用。
让 Agent 看着屏幕操作软件,这一周有两个项目在做。UI-TARS Desktop 用视觉语言模型看截图,再动鼠标键盘。chrome-devtools-mcp 平时按页面快照里的元素编号点击,1 月 9 日加的实验参数打开后,多了按坐标点击的工具。UI-TARS-desktop 仓库里的 Agent TARS 操作浏览器时,视觉和 DOM 两种方式可以混着用。
来源
互联网档案馆存下的 GitHub Trending 日榜,每天一份。
各项目的许可证、发布、提交和 README 内容,取自 GitHub 上对应仓库截至 2026 年 1 月 11 日的历史记录。