✷ AI Open-Source Radar

上週榜上有兩個 Jev 專案,這週有五個

上一期,這份榜單上有兩個專案建立在 Jev 之上——那是 TypeSafe 兩週前發布的決策模型。這一期是五個:Jev 本身在驅動瀏覽器,一個它的開源仿製品,一個開源對手,一個把這個對手移植到 Apple 晶片上的版本,還有 TypeSafe 自家給編碼 Agent 用的技能包——另有第六個,一個聊天副駕,只是借了這個名字。仿製來得很快。Kev 和 Laya 都在發布後三天之內公開,Laya 的 Apple 晶片移植版又只比 Laya 本身晚一天。Star 曲線補上的資訊是:這一波已經在放緩——它們每一個都在頭幾天拿走了一週的大半,到週末只剩涓涓細流。在它周圍,每一期都出現過的那兩個名字分道揚鑣:我們上一期下的判斷,一個成立了,另一個被打破了。

#1 vectorize-io/hindsight —— Hindsight – 一個高準確率、不綁定特定 LLM 的記憶層,讓自主 Agent 更聰明

本週 +13,143 Star → 37,232 · hindsight Star 曲線

更早:2026-08-30 時為 21,777 Star

這個月的大部分時間裡,它是個安靜的專案:一個記憶服務,穩定地細水長流,從沒接近過這份榜單。然後在窗口的最後幾天,它垂直起飛;而且和榜上幾乎所有其他專案不同,這一週結束時它仍在加速——每一次讀數都比前一次大,最後一次是最大的。這恰好和下面那些 Jev 曲線相反,它們這一週都在放緩;這也是下一期最先要核對的形狀。變化的原因在 Star 裡看不到。Vectorize 自己對夏末幾個版本的說明裡寫著:一次安裝就能把一長串編碼 Agent 接進每個儲存庫共用的一個記憶庫;知識頁把一個記憶庫變成可以透過 MCP 存取的 wiki;圖片也能作為記憶保存,讓一條事實引用它的出處。第一條最可能對得上這份榜單——榜上擠滿了 harness 和編排器,它們跑的每一個 Agent 都會在工作階段之間忘事,而這是在它們所有人之間記住東西的那一塊。README 裡的基準測試成績是它自己給的;我們還沒看到別人重現過。

#2 google/ax —— 一個高吞吐的宣告式編排器,在沙箱化的叢集裡執行自主 Agent 工作負載

本週 +9,190 Star → 12,161 · ax Star 曲線

更早:2026-08-30 時為 1,973 Star

Google 幾週前就發布了這個儲存庫,幾乎沒人注意。它一直紋絲不動,直到九月中旬 Google 在 I/O 直播裡介紹了它,然後幾天之內漲了好幾倍。AX 不是模型,也不附帶模型。它是一個用 Go 寫的、Kubernetes 風格的控制平面,圍繞四個原語構建——任務、工作區、閘道和模型——用來隔離不可信的 Agent 程式碼、預先接好 Git 儲存庫和 MCP 伺服器、封鎖對外網路流量,並指向你設定的任何推論端點。發布時打頭的那句話——它能跑數十億個 Agent——正是 Hacker News 上被質疑的那句,而儲存庫裡沒有任何東西能讓你核實它;Star 數也替它擔保不了。曲線能說的更窄:這份關注是一次事件,不是一次發現。和下面的 Jev 專案一樣,AX 在一週開頭拿走了大半,到週末每天只漲開頭的零頭。放在同樣協調大量 Agent 的 Paperclip 和 Orca 旁邊,AX 是寫給維運叢集的人的,而不是寫給坐在終端機前的開發者的。

#3 browser-use/jev-ultrafast —— Jev Ultrafast – 快速的、由 LLM 驅動的瀏覽器自動化,帶動態索引動作空間

本週 +9,019 Star → 20,808 · jev-ultrafast Star 曲線

2026-W39:+8,617 · 與上一期基本持平 · 更早:2026-09-18 時為 3,172 Star

上一期我們把它稱作 Jev 到來的瀏覽器那一半,並把它和騰訊那座橋對照——後者借用你已經登入的那個瀏覽器。它的 README 比這段上方的摘要更精確,而且糾正了那句摘要:選動作的不是語言模型。TypeSafe 的 Jev 讀取由頁面上每個控制項組成的編號表,回答兩個型別化問題——做什麼操作、作用在哪個元素上——而小的文字模型只在選中的操作是輸入文字時才被呼叫。預設迴圈裡不進任何截圖。這種分工就是 Jev 這一波的全部論點,濃縮在一個儲存庫裡:讓決策模型做決策,把生成留給真正需要文字的少數步驟。這也是本期其餘部分存在的原因——Kev 和 Laya 都想把那個決策模型握在自己手裡,而不是租用它。警告在曲線上。它這一週的總量和上週相當,但幾乎全部在頭兩天到帳,到週末每天只漲開頭的一小部分。它仍然是一個附帶開源程式碼的候補名單產品。

#4 paperclipai/paperclip —— 一個開源控制平面,用組織架構圖與預算控管來編排 AI Agent 團隊

本週 +8,683 Star → 89,800 · paperclip Star 曲線

更早:2026-08-31 時為 79,714 Star

#5 rocketride-org/rocketride-server —— 一個開源 AI 開發環境,以視覺化方式組裝並部署高效能 AI 管線

本週 +7,354 Star → 15,830 · rocketride-server Star 曲線

更早:2026-08-30 時為 7,374 Star

#6 debpalash/VoiceStudio —— 一套開源工具,涵蓋 646 種語言的聲音複製、聲音設計與影片配音

本週 +6,541 Star → 40,068 · VoiceStudio Star 曲線

2026-W37:+7,528 · 2026-W38:+6,912 · 2026-W39:+6,788 · 保持同樣的節奏,連續四期在榜 · 更早:2026-08-30 時為 11,977 Star

#7 deepseek-ai/deepseek-harness —— DeepSeek Harness – 一個模組化、外掛驅動的 AI Agent 建構平台

本週 +6,473 Star → 237,664 · deepseek-harness Star 曲線

2026-W35:+42,534 · 2026-W36:+16,749 · 2026-W37:+8,162 · 2026-W38:+8,562 · 2026-W39:+8,642 · 六期上下擺動 · 更早:2026-08-30 時為 203,394 Star

上一期我們說 DeepSeek Harness 連續兩次略微超過了自己,並把這讀作一次下滑的結束,而不是下滑中的一次暫停。這一週給出了相反的答案。它的漲幅重重跌回,落到我們給它記錄過的最小的一週——比它當初爬出來的那個低谷還低。它在八月底那次巨大首秀之後開始的下滑又繼續了,而我們對中間那兩週的解讀是錯的:那是平台,不是底部。對照是 Orca,另一個每期都出現過的名字。我們說過 Orca 以超過任何一週紀錄的成績打破了它的固定速率;這一週它又做到了,連續第二次創紀錄,這讓它旁邊印著的判定有誤導性——它這一段一直是平穩然後上升,從來算不上上下擺動。兩邊的程式碼裡都找不到這種分化的解釋。DeepSeek Harness 是一個通用框架——外掛系統、本地 Web UI、熱重載工具——它的第一批人潮是衝著上面那個名字來的。Orca 是一個窄工具,用來在彼此隔離的 worktree 裡並排跑好幾個編碼 Agent。我們的猜測——而且只是猜測——是一邊的受眾正在縮回到搭框架的那些人,另一邊則隨著每一個開始同時跑不只一個 Agent 的人一起增長。

#8 jaredpalmer/kev —— 一個決策模型,在一次 prefill 中為多個型別化問題輸出校準過的機率

本週 +6,402 Star → 7,413 · kev Star 曲線

更早:2026-09-20 時為 573 Star

TypeSafe 把 Jev 作為一個封閉的付費 API 發布兩天之後,Jared Palmer 公開了一個開源仿製品。Kev 是一組小型決策模型,在 Qwen 上用 LoRA 加一個小的指標頭微調而成,請求形狀與 TypeSafe 的端點相同,所以為其中一個寫的程式碼可以直接指向另一個。它此後長得很快:第一個版本能在筆電上跑,後來的版本一路擴大到需要資料中心 GPU 的模型。誠實的部分是 Palmer 自己公布的對比。在兩個模型都沒訓練過的資料上,他最大的檢查點比 Jev 低幾個百分點;在嚴格的錯誤預算下,它能自動化的決策比例也明顯更小。這正是 Jev 這一波真正擺出來的取捨:Jev 上手更快、更準;Kev 是你自己的——你可以用自己的標註訓練它,在資料所在的地方執行它。它的曲線和本期其他幾個形狀相同:一週的大半在頭幾天,到最後只剩細流。它還會不會再漲,與其說取決於關注度,不如說取決於有沒有人發布一個在某個窄任務上勝過封閉模型的微調——而這正是一個開源仿製品存在的意義。

#9 stablyai/orca —— 一個 AI 編排器,在彼此隔離的 worktree 裡並行執行多個 CLI Agent

本週 +5,983 Star → 79,561 · orca Star 曲線

2026-W35:+5,420 · 2026-W36:+5,522 · 2026-W37:+5,082 · 2026-W38:+5,022 · 2026-W39:+5,789 · 六期上下擺動 · 更早:2026-08-30 時為 56,791 Star

#10 NandhaKishorM/laya —— Laya – 多語言、非自迴歸的決策引擎,即時給出結構化答案

3.8 天內 +5,750 Star → 26,698 · laya Star 曲線

Laya 是對 Jev 的第二個開源回答,比 Kev 晚一天到來,方向正好相反。Kev 微調一個生成式模型,再裝上一個決策頭;Convai Innovations 則把 Laya 建在 BERT 家族的編碼器上——一種早於聊天模型、從來就不生成文字的架構。一個路由器辨識輸入的語言,把問題交給英文檢查點、涵蓋一百多種語言的多語言檢查點,或者專為型別化決策調過的檢查點;每一個都在一次前向傳播裡回傳選項、分數或是非機率,在一塊老的資料中心 GPU 上只要幾十毫秒。權重以 Apache 授權發布。速度來自架構;準確率是另一個問題,而我們還沒找到專案之外有誰在同樣的資料上把它和 Jev 比過。Laya 還有這一週兩張榜上最快的跟隨者:一個透過 MLX 移植到 Apple 晶片的版本第二天就出現了,就在下面的 Breaking out 榜裡,旁邊是 TypeSafe 自己的 skills。它短短的窗口顯示出和這一系其他專案同樣的減速,只是更溫和——每一次讀數都比上一次小,但沒有一次是崩塌。

Breaking out

按相對自身體量的漲幅排序,不是按新增 Star 數。它們小到一週就能翻好幾倍——也小到你多半沒注意過。

newliver666/apk-reverse · 本週 +449.8% → 2,705 Star · apk-reverse Star 曲線

更早:2026-09-21 時為 492 Star

jev-chat/jev-chat-jarvis · 5.8 天內 +327.1% → 6,774 Star · jev-chat-jarvis Star 曲線

mizorewww/laya-mlx · 本週 +239.0% → 6,482 Star · laya-mlx Star 曲線

更早:2026-09-21 時為 1,912 Star

typesafe-ai/skills · 7.7 天內 +179.6% → 2,284 Star · skills Star 曲線

更早:2026-09-20 時為 817 Star

allenpeng0705/EnvoyMesh · 本週 +152.6% → 2,817 Star · EnvoyMesh Star 曲線

更早:2026-09-04 時為 576 Star

下一期要回答的問題是:Jev 這一波有沒有第二週。原版、仿製品、對手和對手的移植版,這一週全都在減速;而前十裡唯一到週末還在加速的那個——Hindsight——和它們毫無關係。如果 Jev 這幾個名字守住了位置,這就是一個品類;如果它們一起掉下去,那只是一個恰好被飛快模仿的發布週。