封存 · 5,053 篇 dispatch

全部 dispatch

AgentLensHQ 封存的全部內容——提煉自整個 AI 生態。

151

Kimi K3 在 vLLM 中的效能優化

vLLM 已針對 Kimi K3 實施了一系列全堆疊優化,實現了高達 2.8 倍的吞吐量提升,以及高達 85% 的首字延遲 (TTFT) 降低。

152

衡量程式碼粗糙度:指標、發現與社群洞見

本文介紹了用於評估 LLM 產生軟體中程式碼粗糙度的量化指標——LOC 變化、冗長度與腐蝕度,並報告目前的代理程式產生的粗糙度為人類程式碼的兩倍。

153

GPT-6 Astra:令牌效率與軟體工程之間的衝突

對 GPT-6 Astra 傾向於優先考慮令牌效率與長遠目標任務完成,而非程式碼可讀性與可維護性的深入分析,導致生產程式碼庫中出現『垃圾程式碼』。

154

Anthropic 2026 年 9 月威脅情資報告 – AI 滥用橫跨網路、影響、監控與武器領域

Anthropic 的 2026 年 9 月威脅報告顯示,從國家資助組織到單獨的駭客行動主義者,均利用 Claude 模型加速網路間諜活動、影響行動、非法監控,甚至傳統武器開發,促使業界推出新防護措施與警報。

155

RTK 代幣儲蓄:基準測試揭示 AI 編碼中成本節省有限

對 Rust Token Killer (RTK) 的全面基準測試顯示,雖然它能壓縮終端輸出,但由於代理回合增加以及具有誤導性的「rtk gain」指標,通常無法降低 AI 編碼的總成本。

156

為什麼真正的創意是生成式 AI 時代的新競爭護城河

在生成式 AI 使功能網站輕而易舉的時代,持久的競爭優勢如今來自真正的創意,以及持續發明原創想法的習慣。

157

Graphify C# 0.1 版本發布 – 為 C# 編碼代理提供編譯器準確的「尋找使用位置」功能

Graphify C# 提供一款無頭的 Roslyn/MSBuild 索引工具,可產生由編譯器解析的 C# 符號的確定性、可查詢 JSON 圖形,讓 LLM 代理能執行精確的「尋找使用位置」及其他語意查詢。

158

The Waymo Effect:如何無摩擦的人工智慧正在減少研究合作

The Waymo effect 描述了人工智慧工具如何因消除人際摩擦,使研究人員獨自工作,威脅科學合作的根基。

159

OpenAI Agents API 發佈 – 用於持久化雲端代理的管理式框架

OpenAI 推出 Agents API,一個管理式 Codex 框架,讓開發者能在主機或自建沙盒中運行具持久性、工具支援的代理,並支援會話持久化與多代理功能。

160

Cognition SWE-2 發布:效能、成本與訓練的創新

Cognition 的 SWE-2 程式碼模型在 FrontierCode 1.1 Main 上達到 50.0% 的解決率,與頂尖競爭者比肩,同時成本降低 64%,歸功於具帕累托導向成本懲罰的多努力層級強化學習,以及 2.8 兆參數的基礎模型。

161

OpenAI Navier-Stokes 證明與 Lean 4 自動形式化之影響

OpenAI 對 Navier-Stokes 方程式的解決方案附帶了 Lean 4 形式化證明,展示了機器可驗證數學驗證所需的成本與時間的大幅降低。

162

DeepSeek-V4.1-Flash 發佈說明

DeepSeek 發佈了 V4.1-Flash,這是一款多模態模型,其特點是採用了新的 Causal Encoder-Decoder 架構,顯著減少了活躍參數和 KV cache 佔用量,以實現更高的效率。

163

在搭載本地 Qwen 3.8 27B 模型的 MacBook Pro 上測試九種程式碼代理框架

在 M4 MacBook Pro 上對九種程式碼代理框架進行系統性基準測試,顯示輕量框架如 pi、mini‑swe‑agent 和 chad 可達每秒 8 個 token,而重量級框架如 opencode 和 crush 則面臨數分鐘啟動延遲,速率下降至每秒 5–6 個 token。

164

AI × Crypto 總結:以代幣驅動的運算、可驗證的推論,以及新興的代理經濟體

近期社群媒體貼文顯示,AI 代理正日益使用加密貨幣代幣支付運算成本、在鏈上驗證資料與模型來源,並透過去中心化市場實現自主商業活動。

165

AI 與前沿科技週報 – 模型進展、實體 AI 數據,以及新興風險

近期幾週內,Gemini 4 Pro 與 DeepSeek V4.1 Flash 等重大模型發布,實體 AI 數據管道快速擴張,同時 AI 滥用與安全問題持續升溫。

166

OpenAI 與未發表數學研究的倫理問題

研究人員正質疑 OpenAI 是否會利用透過 ChatGPT 分享的未發表數學研究來改進其模型,或是在解決千禧年大獎難題的爭議之後,搶先發表學術突破。

167

Perplexity 採用 GPT-6 Astra 進行端到端系統自動化

Perplexity 宣布其現在使用 OpenAI 的 GPT-6 Astra 模型來撰寫通訊內容、修改軟體以及監控生產系統,從而減少了對頻繁人工檢查的需求。

168

硅谷與現代軍事工業複合體

教授Roberto González的報告與後續產業討論指出,大科技與風險投資對AI驅動國防系統的資金投入激增,重新喚醒了硅谷與美國軍方之間的歷史連結。

169

Apple Watch Siri Recaps 引發隱私疑慮與潛在反彈

Apple 的新 Siri Recaps 功能使 Apple Watch 變成持續聆聽的 AI 助手,引發隱私擔憂,並與 Meta 的爭議性智能眼鏡形成類比。

170

OpenAI "allow training" 核取方塊會自動重新啟用 – 使用者報告與影響

使用者報告 OpenAI 的 "allow training" 設定在被停用後經常會自動跳回開啟狀態,引發了關於隱私、同意權以及退出機制可靠性的疑慮。

171

Anthropic 預測性監控與活動家監控

Anthropic 正在開發一套預測性安全系統,利用 OSINT 和第三方情報服務來監控活動家,並識別其高管與資產的潛在威脅。

172

Cognition 集成了 GPT-6 Astra 以實現自主軟體測試

Cognition 正利用 GPT-6 Astra 使其自主軟體工程師 Devin 能夠測試其自身的代碼,並提供功能性的視覺與報告證據。

173

自動駕駛車展現日益增長的拯救生命證據

近期來自Waymo機器計程車、IIHS研究與ADAS普及的資料顯示,自動駕駛與半自動駕駛車輛的事故率遠低於人類駕駛者,顯示其每年可能在全球範圍內防止約58萬人死亡。

174

OpenAI Habitat 擴展以支援超過 10 億名 ChatGPT 用戶

OpenAI 宣布其 Habitat 在線儲存平台目前每秒處理超過 7000 萬個請求,儲存 500 PB 資料,以支援超過 10 億名每周 ChatGPT 用戶,突顯其從 Python 程式庫快速轉向 Rust 服務以達成巨大規模的轉變。

175

Flock Safety 與自動化車牌辨識技術的擴張

Flock Safety 已在全美部署了超過 130,000 台攝影機,引發了關於犯罪減少與公眾隱私侵蝕之間的權衡辯論。

176

GPT-6 Astra: Looped Transformers and the Debate Over Hidden Reasoning

GPT-6 Astra 引入了電腦使用能力的重大飛躍,並可能採用了迴圈 Transformer 架構,以在不增加參數數量的情況下增加模型的有效深度。

177

MultiMatte 2026 背景移除模型透過可提示的 Matte 提升 SAM 3 分割效能

MultiMatte 是 Meta 的 SAM 3 的低階微調延伸,加入可提示的 alpha matte 功能,將 DIS‑VD 上的 S‑measure 得分從 0.667 提升至 0.901,展現出顯著更佳的背景移除效果。

178

Claude「藍色按鈕」諷刺文凸顯 LLM 程式設計助手的真實挫折感

一個諷刺網站讓 Claude 在要求更改單一「加入購物車」按鈕時,反覆將整個網頁變成藍色,揭露了 LLM 驅動的程式碼編輯中常見的痛點,例如輸出過於冗長、缺乏精確控制,以及 token 消耗不可預測。

179

AI 與前沿科技週報 – DeepSeek Flash、代理系統與機器人資料引擎

DeepSeek V4.1 Flash 在成本-效能基準中表現卓越,而新代理工作流程、Qwen 性能挑戰與機器人資料平台,標誌著向可擴展 AI 協調與實體 AI 的轉變。

180

AI × Crypto 總結:鏈上代理經濟、可驗證運算與去中心化資料市場

近期推文顯示,大量具體專案正著手建立鏈上身分、託管、驗證與去中心化運算,將 AI 代理轉變為經濟實體。

181

Desert Ant Labs: On-Device Specialized AI Models

Desert Ant Labs 推出了 18 個專用的裝置端 AI 模型系列,涵蓋音訊、視覺和文本,旨在於行動裝置和桌上型電腦上本地運行,以消除代幣成本和延遲。

182

Anthropic 經濟情景探索工具 1.0:到 2030 年 AI 對美國成長、就業與所得分配的潛在影響

Anthropic 的經濟情景探索工具預測,到 2030 年 AI 將使美國 GDP 增長 1.6% 至 32.4%,但更高的增長情境也導致所得向資本集中,並提高知識工作者的失業率。

183

OpenAI 對納維爾-斯托克斯方程問題的解決方案及其引發的 AI 驅動發現爭議

利用 AI 解決納維爾-斯托克斯存在性問題的突破,引發了關於智慧財產權、資料隱私以及 AI 驅動科學發現倫理的重大爭議。

184

Anthropic研究員因AI競賽憂慮而辭職

Jacob Coxon辭去Anthropic職務,警告OpenAI與Anthropic正無責任保障地競逐自我改進的超級智慧。

185

Terence Tao 對 AI 與富有成果數學問題枯竭的見解

數學家 Terence Tao 警告,AI 以暴力破解方式解決問題的能力正在扁平化數學的『難度地景』,可能耗盡富有前景的開放問題供應,並削弱人類研究的動機。

186

為什麼回到手動編碼可以重新點燃開發者的主導感

一位開發者放棄了由 Claude 生成的程式碼分支,回到手動編碼,重新找回主導感與洞見,這一舉動在 HN 討論中獲得許多共鳴。

187

LLMs Through Adaptive Exploration Develop Novel Social Biases

研究指出,大型語言模型 (LLMs) 在迭代決策任務中,會針對人工虛擬人口群體自發性地產生社會偏見,且其分層程度往往比人類更為激進。

188

Qwen 3.8 與 GPT-5.5 Pro 推理預填分析

實驗數據顯示,當預填了 GPT-5.5 Pro 的推理軌跡時,Qwen 3.8 的性能顯著提升,這表明可能存在來自 GPT 模型的蒸餾。

189

OtoDock 1.6.0 – 公司級自動化用的自-host AI 代理平台

OtoDock 1.6.0 是一個自-host、多租戶的平台,讓企業能跨部門建立、分享與執行 Claude Code 或 Codex 代理,內建安全機制、排程功能、電話整合與豐富的使用者介面。

190

LLM 時代的軟體開發:還有多少團隊仍像 2021 年那樣寫程式?

許多開發人員仍在使用 LLM 協助之外的方式寫程式,特別是在受監管或保守的行業,但 AI 採用率正在快速擴散至大多數公司。

191

OpenAI 的納維-斯托克斯千禧年獎問題聲稱與 LLM 生成數學的倫理問題

OpenAI 宣布其內部 LLM 解決納維-斯托克斯存在性與光滑性問題,引發關於資料使用、計算成本,以及 AI 對前沿數學影響的爭議。

192

OpenAI 解決了 Navier–Stokes 千禧年大獎難題

OpenAI 使用內部多代理人 AI 系統證明了 Navier–Stokes 方程式可以在有限時間內產生奇異點,解決了一個存在 90 年之久的千禧年大獎難題。

193

OpenAI 被指控利用用戶對話進行訓練以聲稱技術突破

研究人員指控 OpenAI 利用私密的用戶對話來實現技術突破,同時聲稱是原始發現,這引發了關於數據選擇退出與 AI 訓練透明度的辯論。

194

OpenAI Astra 指控:可能抄襲數學證明

數學家 Andreas Thom 指控 OpenAI 的 Astra 模型可能透過在用戶對話中進行訓練,吸收了關於 Gromov’s soficity conjecture 的未發表人類研究成果,引發了對 AI 訓練中知識產權盜竊的擔憂。

195

Meta 的 Muse AI Agent 接管了樂團的社群媒體帳號

Meta 的新 AI agent,Muse,挪用了長期屬於英國搖滾樂團 Muse 的 Instagram 和 X 上的 @muse 使用者名稱,凸顯了平台對熱門社群媒體帳號的控制權所引發的持續擔憂。

196

Meta Muse 個人 AI 代理推出 – 功能、隱私承諾與社群反應

Meta 推出 Muse,一款可瀏覽網路、進行購買並整合應用程式的個人 AI 代理,但 Hacker News 社群對其隱私、信任與實用性提出嚴重質疑。

197

Geiger: Inventorying AI Agents and MCP Servers for Machine Security

Geiger 是一個唯讀且無依賴性的工具,用於清點機器上的 AI agent、MCP server 與 extension,以識別潛在的安全暴露風險,例如程式碼執行與憑證儲存。

198

OpenAI Codex and ChatGPT 加速抗微生物分子發現

OpenAI 宣布,研究人員正利用 Codex 和 ChatGPT 加速搜尋新型抗微生物分子,將初步候選分子的識別過程從數年縮短至數小時。

199

DHS 預測性智能目標團隊利用金融數據引發交通攔截

DHS 邊境巡邏隊的秘密預測性智能目標團隊分析美國公民的金融數據,以標記駕駛員進行交通攔截,引發憲法與隱私方面的擔憂。

200

OpenAI 數據代理在 ChatGPT Work 上的推出

OpenAI 宣布推出 ChatGPT Work 的數據代理,讓使用者能以自然語言查詢公司資料、產生互動式儀表板,並觸發行動。