✷ AI Open-Source Radar
上周榜上有两个 Jev 项目,这周有五个
上一期,这份榜单上有两个项目建立在 Jev 之上——那是 TypeSafe 两周前发布的决策模型。这一期是五个:Jev 本身在驱动浏览器,一个它的开源仿制品,一个开源对手,一个把这个对手移植到 Apple 芯片上的版本,还有 TypeSafe 自家给编码 Agent 用的技能包——另有第六个,一个聊天副驾,只是借了这个名字。仿制来得很快。Kev 和 Laya 都在发布后三天之内公开,Laya 的 Apple 芯片移植版又只比 Laya 本身晚一天。Star 曲线补上的信息是:这一波已经在放缓——它们每一个都在头几天拿走了一周的大半,到周末只剩涓涓细流。在它周围,每一期都出现过的那两个名字分道扬镳:我们上一期下的判断,一个成立了,另一个被打破了。
#1 vectorize-io/hindsight —— Hindsight – 一个高准确率、不绑定特定 LLM 的记忆层,让自主 Agent 更聪明
本周 +13,143 Star → 37,232 · hindsight Star 曲线
更早:2026-08-30 时为 21,777 Star
这个月的大部分时间里,它是个安静的项目:一个记忆服务,稳定地细水长流,从没接近过这份榜单。然后在窗口的最后几天,它垂直起飞;而且和榜上几乎所有其他项目不同,这一周结束时它仍在加速——每一次读数都比前一次大,最后一次是最大的。这恰好和下面那些 Jev 曲线相反,它们这一周都在放缓;这也是下一期最先要核对的形状。变化的原因在 Star 里看不到。Vectorize 自己对夏末几个版本的说明里写着:一次安装就能把一长串编码 Agent 接进每个仓库共用的一个记忆库;知识页把一个记忆库变成可以通过 MCP 访问的 wiki;图片也能作为记忆保存,让一条事实引用它的出处。第一条最可能对得上这份榜单——榜上挤满了 harness 和编排器,它们跑的每一个 Agent 都会在会话之间忘事,而这是在它们所有人之间记住东西的那一块。README 里的基准测试成绩是它自己给的;我们还没看到别人复现过。
#2 google/ax —— 一个高吞吐的声明式编排器,在沙箱化的集群里运行自主 Agent 工作负载
本周 +9,190 Star → 12,161 · ax Star 曲线
更早:2026-08-30 时为 1,973 Star
Google 几周前就发布了这个仓库,几乎没人注意。它一直纹丝不动,直到九月中旬 Google 在 I/O 直播里介绍了它,然后几天之内涨了好几倍。AX 不是模型,也不附带模型。它是一个用 Go 写的、Kubernetes 风格的控制平面,围绕四个原语构建——任务、工作区、网关和模型——用来隔离不可信的 Agent 代码、预先接好 Git 仓库和 MCP 服务器、封锁出站网络流量,并指向你配置的任何推理端点。发布时打头的那句话——它能跑数十亿个 Agent——正是 Hacker News 上被质疑的那句,而仓库里没有任何东西能让你核实它;Star 数也替它担保不了。曲线能说的更窄:这份关注是一次事件,不是一次发现。和下面的 Jev 项目一样,AX 在一周开头拿走了大半,到周末每天只涨开头的零头。放在同样协调大量 Agent 的 Paperclip 和 Orca 旁边,AX 是写给运维集群的人的,而不是写给坐在终端前的开发者的。
#3 browser-use/jev-ultrafast —— Jev Ultrafast – 快速的、由 LLM 驱动的浏览器自动化,带动态索引动作空间
本周 +9,019 Star → 20,808 · jev-ultrafast Star 曲线
2026-W39:+8,617 · 与上一期基本持平 · 更早:2026-09-18 时为 3,172 Star
上一期我们把它称作 Jev 到来的浏览器那一半,并把它和腾讯那座桥对照——后者借用你已经登录的那个浏览器。它的 README 比这段上方的摘要更精确,而且纠正了那句摘要:选动作的不是语言模型。TypeSafe 的 Jev 读取由页面上每个控件组成的编号表,回答两个类型化问题——做什么操作、作用在哪个元素上——而小的文本模型只在选中的操作是输入文字时才被调用。默认循环里不进任何截图。这种分工就是 Jev 这一波的全部论点,浓缩在一个仓库里:让决策模型做决策,把生成留给真正需要文字的少数步骤。这也是本期其余部分存在的原因——Kev 和 Laya 都想把那个决策模型握在自己手里,而不是租用它。警告在曲线上。它这一周的总量和上周相当,但几乎全部在头两天到账,到周末每天只涨开头的一小部分。它仍然是一个附带开源代码的候补名单产品。
#4 paperclipai/paperclip —— 一个开源控制平面,用组织架构图与预算控制来编排 AI Agent 团队
本周 +8,683 Star → 89,800 · paperclip Star 曲线
更早:2026-08-31 时为 79,714 Star
#5 rocketride-org/rocketride-server —— 一个开源 AI 开发环境,可视化地组装并部署高性能 AI 流水线
本周 +7,354 Star → 15,830 · rocketride-server Star 曲线
更早:2026-08-30 时为 7,374 Star
#6 debpalash/VoiceStudio —— 一套开源工具,覆盖 646 种语言的声音克隆、声音设计与视频配音
本周 +6,541 Star → 40,068 · VoiceStudio Star 曲线
2026-W37:+7,528 · 2026-W38:+6,912 · 2026-W39:+6,788 · 保持同样的节奏,连续四期在榜 · 更早:2026-08-30 时为 11,977 Star
#7 deepseek-ai/deepseek-harness —— DeepSeek Harness – 一个模块化、插件驱动的 AI Agent 构建平台
本周 +6,473 Star → 237,664 · deepseek-harness Star 曲线
2026-W35:+42,534 · 2026-W36:+16,749 · 2026-W37:+8,162 · 2026-W38:+8,562 · 2026-W39:+8,642 · 六期上下摆动 · 更早:2026-08-30 时为 203,394 Star
上一期我们说 DeepSeek Harness 连续两次略微超过了自己,并把这读作一次下滑的结束,而不是下滑中的一次暂停。这一周给出了相反的答案。它的涨幅重重跌回,落到我们给它记录过的最小的一周——比它当初爬出来的那个低谷还低。它在八月底那次巨大首秀之后开始的下滑又继续了,而我们对中间那两周的解读是错的:那是平台,不是底部。对照是 Orca,另一个每期都出现过的名字。我们说过 Orca 以超过任何一周记录的成绩打破了它的固定速率;这一周它又做到了,连续第二次创纪录,这让它旁边印着的判定有误导性——它这一段一直是平稳然后上升,从来算不上上下摆动。两边的代码里都找不到这种分化的解释。DeepSeek Harness 是一个通用框架——插件系统、本地 Web UI、热重载工具——它的第一批人群是冲着上面那个名字来的。Orca 是一个窄工具,用来在彼此隔离的 worktree 里并排跑好几个编码 Agent。我们的猜测——而且只是猜测——是一边的受众正在缩回到搭框架的那些人,另一边则随着每一个开始同时跑不止一个 Agent 的人一起增长。
#8 jaredpalmer/kev —— 一个决策模型,在一次 prefill 中为多个类型化问题输出校准过的概率
本周 +6,402 Star → 7,413 · kev Star 曲线
更早:2026-09-20 时为 573 Star
TypeSafe 把 Jev 作为一个封闭的付费 API 发布两天之后,Jared Palmer 公开了一个开源仿制品。Kev 是一组小型决策模型,在 Qwen 上用 LoRA 加一个小的指针头微调而成,请求形状与 TypeSafe 的端点相同,所以为其中一个写的代码可以直接指向另一个。它此后长得很快:第一个版本能在笔记本上跑,后来的版本一路扩大到需要数据中心 GPU 的模型。诚实的部分是 Palmer 自己公布的对比。在两个模型都没训练过的数据上,他最大的检查点比 Jev 低几个百分点;在严格的错误预算下,它能自动化的决策比例也明显更小。这正是 Jev 这一波真正摆出来的取舍:Jev 上手更快、更准;Kev 是你自己的——你可以用自己的标注训练它,在数据所在的地方运行它。它的曲线和本期其他几个形状相同:一周的大半在头几天,到最后只剩细流。它还会不会再涨,与其说取决于关注度,不如说取决于有没有人发布一个在某个窄任务上胜过封闭模型的微调——而这正是一个开源仿制品存在的意义。
#9 stablyai/orca —— 一个 AI 编排器,在彼此隔离的 worktree 里并行运行多个 CLI Agent
本周 +5,983 Star → 79,561 · orca Star 曲线
2026-W35:+5,420 · 2026-W36:+5,522 · 2026-W37:+5,082 · 2026-W38:+5,022 · 2026-W39:+5,789 · 六期上下摆动 · 更早:2026-08-30 时为 56,791 Star
#10 NandhaKishorM/laya —— Laya – 多语言、非自回归的决策引擎,即时给出结构化答案
3.8 天内 +5,750 Star → 26,698 · laya Star 曲线
Laya 是对 Jev 的第二个开源回答,比 Kev 晚一天到来,方向正好相反。Kev 微调一个生成式模型,再装上一个决策头;Convai Innovations 则把 Laya 建在 BERT 家族的编码器上——一种早于聊天模型、从来就不生成文本的架构。一个路由器识别输入的语言,把问题交给英文检查点、覆盖一百多种语言的多语言检查点,或者专为类型化决策调过的检查点;每一个都在一次前向传播里返回选项、分数或是非概率,在一块老的数据中心 GPU 上只要几十毫秒。权重以 Apache 许可发布。速度来自架构;准确率是另一个问题,而我们还没找到项目之外有谁在同样的数据上把它和 Jev 比过。Laya 还有这一周两张榜上最快的跟随者:一个通过 MLX 移植到 Apple 芯片的版本第二天就出现了,就在下面的 Breaking out 榜里,旁边是 TypeSafe 自己的 skills。它短短的窗口显示出和这一系其他项目同样的减速,只是更温和——每一次读数都比上一次小,但没有一次是崩塌。
Breaking out
按相对自身体量的涨幅排序,不是按新增 Star 数。它们小到一周就能翻好几倍——也小到你多半没注意过。
newliver666/apk-reverse · 本周 +449.8% → 2,705 Star · apk-reverse Star 曲线
更早:2026-09-21 时为 492 Star
jev-chat/jev-chat-jarvis · 5.8 天内 +327.1% → 6,774 Star · jev-chat-jarvis Star 曲线
mizorewww/laya-mlx · 本周 +239.0% → 6,482 Star · laya-mlx Star 曲线
更早:2026-09-21 时为 1,912 Star
typesafe-ai/skills · 7.7 天内 +179.6% → 2,284 Star · skills Star 曲线
更早:2026-09-20 时为 817 Star
allenpeng0705/EnvoyMesh · 本周 +152.6% → 2,817 Star · EnvoyMesh Star 曲线
更早:2026-09-04 时为 576 Star
下一期要回答的问题是:Jev 这一波有没有第二周。原版、仿制品、对手和对手的移植版,这一周全都在减速;而前十里唯一到周末还在加速的那个——Hindsight——和它们毫无关系。如果 Jev 这几个名字守住了位置,这就是一个品类;如果它们一起掉下去,那只是一个恰好被飞快模仿的发布周。