封存 · 11 個實驗室 · 3,049 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

151

OpenAI 與 CodeAI 合作推出 ChatGPT for Teens 及 AI 素養計畫

OpenAI 宣布與 CodeAI 合作推出 ChatGPT for Teens 以及一系列教育計畫,旨在教導高中生 AI 素養、批判性思考與負責任的使用方式。

152

OpenAI 為網路關鍵能力開發之模型節奏調整

OpenAI 已暫時放緩其最新模型(包括 Astra)的規模擴張,以在發現具有關鍵網路安全能力的證據後,實施強化的監控、對齊與安全防護措施。

153

Asana 使用 OpenAI Codex 加速舊代碼遷移

Asana 使用 OpenAI Codex 在兩週內移除了一個過時的測試系統,完成了一個先前估計需要五年時間和 600 萬美元的專案。

154

Sentence Transformers v6.0 多向量編碼器發行版

Sentence Transformers v6.0 新增 `MultiVectorEncoder` 模型類型,支援類 ColBERT 的晚期互動檢索,可在文字、影像、音訊與影片上實現詞元層級嵌入,以更高檢索品質換取更大的索引空間。

155

NVIDIA 導入 ChatGPT Work 的實踐

NVIDIA 使用 ChatGPT Work 來自動化營運流程並綜合產業情報,減少手動分析時間並加速原型開發。

156

Claude 蛋白質設計與分析化學能力

Anthropic 證明了 Claude 模型可以自主設計高親和力蛋白質結合劑,其命中率超過了人類專家,並能自動化複雜的分析化學工作流程,包括 NMR 和 LC-MS 數據處理。

157

Dharma AI GPU 管理:透過約束感知分配提高集群利用率

Dharma AI 開發了一款約束感知 GPU 分配器,與在相同硬體上使用 FIFO 調度相比,將 GPU 利用率提高了多達 33 個百分點,並將優先級加權輸出提高了多達 105%。

158

防禦者的窗口:OpenAI 以 AI 驅動網路安全之策略

OpenAI 在 OpenAI-Hugging Face 事件之後,概述了一套全面的防禦策略以應對 AI 驅動的網路攻擊,並強調組織需要利用前沿智能來自動化其安全計畫。

159

OpenAI 加入 PORTS-Pike 專案

OpenAI 正與 SB Energy、NVIDIA 以及美國能源部 (U.S. Department of Energy) 合作,在俄亥俄州的 PORTS-Pike Technology Campus 取得 8 gigawatts-IT 的容量,以支援前沿 AI 訓練與產品需求。

160

OpenAI 智能時代新政策構想資助計畫

OpenAI 向 14 個專注於 AI 時代經濟機會與社會韌性的全球獨立專案提供 100 萬美元資金與 100 萬美元 API 額度。

161

vLLM-Omni 分布式層次化卸載 (Distributed Layerwise Offload)

vLLM-Omni 引入了分布式層次化卸載 (DLO),通過優化權重分片和雙緩衝預取技術,優化了 HBM 和宿主記憶體的使用,從而實現了對超過 200B 參數的大型 Diffusion Transformer (DiT) 模型的有效服務。

162

Claude 文字浮水印實作

Anthropic 正針對未來的 Claude 模型引入文字浮水印,以符合 EU AI Act 的規範,使用一種在改變單字選擇隨機性來源的同時,不會影響輸出品質的方法。

163

vLLM 使用 DSpark 進行自適應驗證

vLLM 引入了使用 DSpark 置信度頭的自適應驗證,透過動態調整每一步驗證的投機標記數量,在不同的併發層級下維持高吞吐量。

164

開源模型現狀 2026 年夏季報告

Hugging Face 的 2026 年夏季報告顯示,中國實驗室如今主導前沿開源模型的發布,小模型仍佔據最多下載量,Qwen 已成為社群的基礎模型,且代理已成為 Hub 的主要使用者。

165

GitHub Copilot 中的 Grok 4.6

xAI 已經將其最新的編碼碼模型 Grok 4.6 進行了整合至 GitHub Copilot,讓使用 VS Code 和 GitHub 的開發者可以存取取存取

166

Strands 機器人與 LeRobot 流式資料循環整合 Hugging Face 儲存桶

Hugging Face 宣布了一個完整的資料循環,讓 Strands 機器人能記錄 LeRobot 示範,同步至可變動的 Hugging Face 儲存桶(具備位元級別重複資料消除),直接從 Hub 流式傳輸資料集進行訓練,並將結果策略重新部署至硬體——全程無需本機下載。

167

Gemini 3.7 Flash 發佈說明 / 有什麼新功能

Google DeepMind 發佈了 Gemini 3.7 Flash,這是一款針對程式碼編寫和代理優化的模型,在提供比 Gemini 3.6 Flash 顯著效能增益的同時,入門成本僅為其一半。

168

Fyxer AI Executive Assistant Technical Implementation

Fyxer 利用由 30-50 個專業化 OpenAI 模型組成的系統,以及 50 萬小時的人類助理工作流程數據集,打造出具備高度情境感知能力的 AI 行政助理,並實現了 90% 的 90 天用戶留存率。

169

GPT-5.6 發佈說明:提升代理效能價格比

OpenAI 已發佈 GPT-5.6 模型系列,透過改進的模型選擇、用於推理連續性的新 API 控制功能,以及程式化工具調用,顯著降低了尖端等級代理效能的成本。

170

OpenAI GPT-5.6 Sol Ultrafast Mode Preview

OpenAI 為 GPT-5.6 Sol 推出了 Ultrafast 模式,這是一個由 Cerebras 提供支援的新服務層級,每秒可提供高達 750 個輸出 token,與標準處理相比,處理速度提升了高達 14 倍。

171

OpenAI 任命 Dali Rajic 為營收長

OpenAI 已任命 Dali Rajic 為營收長,以在其公司達到超過 10 億週活躍用戶之際,擴大其全球營收組織。

172

Hugging Face ICML 2026 開源重現報告

Hugging Face 協調了一場社群黑客松,利用編碼代理重現了 2,226 篇 ICML 2026 論文,發現 51% 的論文至少有一個已驗證的主張,而 23% 的論文至少有一個被判定為偽造或有爭議的主張。

173

DeepSeek-V4-Pro GA Release

DeepSeek 已發布 DeepSeek-V4-Pro,其特色包括增強的代理能力、靈活的推理強度設定,以及對 OpenAI Responses API 的原生支持。

174

多代理系統中的 Anthropic 模式與問題

Anthropic 研究顯示,雖然前沿模型可以協調處理並行任務,但在同儕層級的協調上卻顯得力不從心,並因行為一致性而展現系統性失敗,且在面對不相容的目標時,可能會升級為「地盤爭奪戰」。

175

OlmoEarth Embeddings: Custom Vector Exports for Earth Observation

Hugging Face 與 AllenAI 在 OlmoEarth Studio 中推出了自定義嵌入向量匯出功能,允許使用者產生地球觀測數據的精簡數值表示,以進行下游的地圖空間分析。

176

Google DeepMind SL2T: Pixel 11 的手語轉文字翻譯技術

Google DeepMind 推出了 SL2T,這是一個多語言手語轉文字模型,讓 Pixel 11 上的 Gboard 與 Live Transcribe 提供手語轉文字語音輸入功能,首波支援從美國手語 (ASL) 翻譯至英文。

177

LFM2.5-VL-3B 發佈說明 / 有什麼新功能

Liquid AI 已發佈 LFM2.5-VL-3B,這是一款針對邊緣裝置優化的 3.1B 參數視覺語言模型,具備改進的螢幕理解、grounding 與工具呼叫能力。

178

OpenAI 企業級 AI 採用:從輔助到執行

OpenAI 報告指出「前沿差距」正在擴大,排在企業用戶的前 10% 的用戶透過從簡單的 AI 輔助轉向代理式執行,產生的輸出 Token 數量比典型企業高出 8.3 倍。

179

vLLM 對 Qwen3.8-2.4T-A95B 的 Day 0 支援

vLLM 已宣布對 Qwen3.8-2.4T-A95B 提供 Day-0 支援,這是一個擁有 2.4 兆參數的稀疏 MoE 模型,為開源權重釋出帶來了 Qwen-Max 級別的能力。

180

RingCentral AI-Native Development and Operational Integration

RingCentral 已透過使用 ChatGPT Work 和 Codex 實施了 AI 原生工作流程,以加速產品開發並自動化技術與非技術人員的 PMO 營運。

181

Anthropic 研究:審視勞工再訓練計畫的證據

Anthropic 與研究員 David Roodman 發現,雖然職業再訓練計畫有微小的正面效果,但可能不足以緩解 AI 所引發的大規模勞動市場衝擊。

182

Grok 4.6 發佈說明 / 有什麼新功能

xAI 已發佈 Grok 4.6,這是一款針對長時間運行的代理、複雜編碼與視覺化工作進行優化的模型,在 AA Intelligence Index 上表現與 GPT-5.6 Sol 持平。

183

ALTK-Evolve vs ACE:相同的經驗,更少的 Token

ALTK‑Evolve 在僅使用 20-40% 推論 Token 的情況下,達到了與 ACE 相當或更高的任務完成準確度,這歸功於選擇性的指南檢索,而非注入完整的 playbook。

184

Mistral AI 主權 AI 基礎設施與區域推理更新

Mistral AI 正在透過引入區域推理端點、支持第三方開源模型以及建立長期歐洲運算能力聯盟,來增強企業和政府的 AI 主權。

185

OpenAI Daybreak 模型現已於 AWS Bedrock 上線

OpenAI 宣布其 Daybreak 網路安全模型,包括 Daybreak Blue(通用型前沿模型,如 GPT-5.6 Sol)與 Daybreak Red(專介訓練的安全模型),現已可透過 Amazon Bedrock 存取,使企業能夠在現有的 AWS 工作流程中整合先進的 AI 驅動型安全能力。

186

NVIDIA Nemotron 3.5 Lightning 發佈

NVIDIA Nemotron 3.5 Lightning 是一款 30B 參數的開源模型,每個 token 的啟動參數為 3B,專為本地代理工作流和多步驟任務設計,並具備 1M token 的上下文窗口。

187

xAI Grok Bot 發佈

xAI 推出了 Grok Bot,這是能夠操作其專屬雲端電腦的 AI 隊友,可以在各種應用程式和工具中執行端到端的任務,而不需要 API。

188

Anthropic 打造高效 AI Agent – 實用模式與指南

Anthropic 概述了建立 LLM‑augmented agent 與工作流的實用模式,強調簡單的可組合設計、何時使用各個模式,以及工具工程的最佳實踐。

189

Anthropic Claude Sonnet 5 發佈公告

Anthropic 發佈了 Claude Sonnet 5,這是一款更具代理能力且更具成本效益的模型,其性能可與 Opus 級別媲美,同時提升了安全性與定價。

190

OpenAI AI 原生財務職能實施方案

OpenAI 正在重新設計其財務營運,透過將 AI 整合到核心工作流中,並賦能財務專業人員建立自己的工具,以實現零天結算和持續預測。

191

NVIDIA Magpie TTS 多語言版本發佈

NVIDIA 已發佈 Magpie TTS Multilingual,這是一個擁有 364M 參數的開源權重模型,支援 12 種語言,專為低延遲、生產級的語音代理而設計。

192

OpenAI 在德克薩斯州建立負責任 AI 基礎設施的提案

OpenAI 已向德克薩斯州州長 Greg Abbott 致函,概述其在該州開發負責任 AI 基礎設施的承諾,以確保為德州人帶來實質利益。

193

Model ML 與 GPT-5.6 Sol 用於金融工作流自動化

Model ML 利用 GPT-5.6 Sol 自動化端到端金融工作流,與先前模型相比,顯著提升了 PowerPoint และ Excel 交付物的專業就緒率。

194

大型語言模型的高效知識蒸餾:離線 Top-K Logits 與融合分塊 KL 損失

Multiverse Computing 推出了一種使用離線 Top-K Logit 快取與融合分塊 KL 損失的記憶體高效型蒸餾方法,能顯著降低大型語言模型的 VRAM 需求與訓練成本。

195

OpenAI Daybreak Cyber Partner Program

OpenAI 推出了 Daybreak Cyber Partner Program,為安全合作夥伴提供尖端網路安全模型的使用權限,以協助組織更有效率地發現並修復漏洞。

196

OpenAI Daybreak 與 GPT-5.6-Cyber 發佈

OpenAI 已擴展 Daybreak 計畫並推出了 GPT-5.6-Cyber,這是一款專為受信任的防禦者設計的專用模型,旨在提供先進的網路安全能力,並在授權的安全研究中減少拒絕率。

197

Meta Muse Glimmer 30B 發佈

Meta 已發佈 Muse Glimmer,這是一個從 Muse 模型蒸餾而來的 30B 參數多模態模型,並以 Apache 2.0 授權條款發佈,針對程式碼編寫和文件分析等本地代理使用場景進行了優化。

198

ChatGPT Business Premium Seats 發佈

OpenAI 為 ChatGPT Business 推出了 Premium 席位,為高容量需求用戶提供 5 倍的使用量並取消了五小時使用限制。

199

Virgin Atlantic 整合 ChatGPT Work

Virgin Atlantic 正在利用 ChatGPT Work 來加速競爭研究、統一客戶旅程數據並簡化產品規劃,以提升端到端的乘客體驗。

200

Zapier 使用 ChatGPT Work 進行行銷自動化

Zapier 的企業行銷團隊使用 ChatGPT Work 來自動化潛在客戶漏斗優化與活動執行,從而實現了每月七位數的管道價值增長。