封存 · 11 個實驗室 · 3,049 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

01

Qwen-Image-2.1 發布說明 / 新功能

Qwen-Image-2.1 是一款統一的 7B 參數圖像模型,將文字生成圖像、原生透明度支援與進階圖像編輯功能整合至單一高效架構中。

02

OpenAI 推出澳洲青少年安全藍圖

OpenAI 推出了澳洲青少年安全藍圖,這是一項包含六大支柱的藍圖,旨在透過增強的保護措施、素養教育和問責制,保護 13 至 17 歲使用 AI 的年輕人。

03

Qwen3.8-LiveTranslate 模型發布

Qwen 宣布推出 Qwen3.8‑LiveTranslate,這是一款即時同步口譯模型,將平均延遲降低至 2.3 秒,新增說話者分離、雙語螢幕輸出與跨 60 種輸入語言的長上下文消歧義功能。

04

Anthropic 與 Accenture 合作推動前沿 AI 的嵌入式評估

Anthropic 正與 Accenture 合作實施嵌入式評估,授予獨立評估人員深入的內部存取權限,以驗證安全承諾與模型開發。

05

vLLM 使用 PyNvVideoCodec 在多 GPU 上擴展影片字幕生成

vLLM 現在支援透過 PyNvVideoCodec 使用 NVIDIA 硬體影片解碼,移除了 CPU 瓶頸,並在 H100 GPU 上使多 GPU 影片字幕生成任務的吞吐量超過兩倍。

06

Qwen3.8-Omni-Flash 發布:具備 1M Token 上下文的多模態代理模型

Qwen 宣布推出 Qwen3.8-Omni-Flash 模型,這是一款下一代多模態大語言模型,具備 100 萬 token 的上下文視窗、針對音訊與視訊任務的代理能力,以及大幅降低的音訊與視訊 API 成本。

07

Cooley GO Public:利用 ChatGPT Work 加速 IPO 工作流程

律師事務所 Cooley 開發了 GO Public,一款基於 ChatGPT Work 的專有代理式 AI 產品,用於自動化 IPO 資料的綜合並加速資本市場交易的準備。

08

Anthropic 生命科學驗證計畫

Anthropic 推出生命科學驗證計畫(LSVP),讓經過驗證的生命科學專業人士能以較寬鬆的保障機制,使用 Mythos、Opus 和 Sonnet 模型進行生物相關工作。

09

Claude 加速開源生物分子模型 4 倍,並在單一 GPU 上實現超過 10,000 token 的預測

Anthropic 宣布 Claude 優化了超過 30 種開源生物分子模型,實現約 4 倍提速,推出可在單一 GPU 上處理超過 10,000 token 系統的低記憶體「Big」模式,並宣布一項總額達 100 萬美元的蛋白質設計競賽。

10

OpenAI Astra for Law 發布

OpenAI 推出 Astra for Law,一個專為法律領域設計的基礎架構,結合 GPT-6 Astra 與龐大的法律搜尋索引,以及符合專業級別的隱私控制,供律師事務所與法律科技公司使用。

11

OpenAI 模型錯位報告框架

OpenAI 推出一套系統性框架,以加速披露模型錯位案例,並發布了六份初期報告,展示模型在訓練或評估期間出現的意外行為。

12

OpenAI 推出高齡者 AI 技能研習營,教授 ChatGPT 的使用方法

OpenAI 宣布推出高齡者 AI 技能研習營,這是一項免費的面授計畫,旨在教導長者如何安全且有效地使用 ChatGPT,進而擴大高齡人口對 AI 的普及性。

13

OpenAI 以 AI 重新想像廣告

OpenAI 正在推出贊助代理人、AI 驅動的廣告活動管理工具,以及與 HubSpot 和 Shopify 的整合,以建立一個 AI 原生的廣告平台。

14

OpenAI Admin Console Analytics: Connecting AI Usage to Business Value

OpenAI 在 ChatGPT Admin Console 中推出了新的分析功能,結合了使用量、成本、任務與結果數據,幫助管理員量化 AI 的業務影響並引導投資決發。

15

Hex 整合 GPT-6 Astra 以實現進階的資料視覺化與分析

Hex 已整合 GPT-6 Astra,以支援建立複雜且互動的資料作品,並提升資料報告中的分析判斷力。

16

OpenAI Unlocking New Ways of Working Report Shows Cross‑Occupation AI Use Becomes Recurring

OpenAI 的新研究報告發現,工作者正日益將跨職業的 AI 任務納入常規工作流程,顯示在職稱變動前已出現早期的工作內容擴張。

17

Mistral AI 與 Mozilla 合作,利用開放且私密的語言模型為 Firefox Smart Window 提供動力

Mistral AI 宣布與 Mozilla 合作,將其開放權重、多語言模型整合至 Firefox Smart Window,在瀏覽器中提供以隱私為先、在本地微調的 AI 輔助功能。

18

Gemini 3.8 Live 與 3.8 Live Extended Thinking 發佈

Google DeepMind 推出了 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking,這是先進的即時對話模型,旨在為具備增強推理與視覺定位能力的即時語音代理提供服務。

19

ALTK-Evolve 一致性指南以提升代理可靠性

Hugging Face 和 IBM Research 引入了 Consistency Analyzer 與一致性指南,以縮小代理平均準確度與可靠、可重複成功之間的差距。

20

vLLM Kimi-K3 DSpark 推測解碼實作

vLLM 已為 2.8T 參數的 Kimi K3 模型實作了 DSpark 推測器,將數學推理的互動性從 110 提升至 435 tok/s/user,並提供高達 3.5 倍的輸出吞吐量。

21

vLLM 與 Novita AI 發布 Chord:針對 Kimi K2.x 的更快 INT4 MoE 核心

Novita AI 將 Chord 開源,這是一個 W4A16 MoE CUDA 操作器,可使 INT4 量化 Kimi K2.x 服務速度比公開的 Humming 核心快達 2.15×。

22

Kimi K3 在 vLLM 中的效能優化

vLLM 已針對 Kimi K3 實施了一系列全堆疊優化,實現了高達 2.8 倍的吞吐量提升,以及高達 85% 的首字延遲 (TTFT) 降低。

23

Perplexity 採用 GPT-6 Astra 進行端到端系統自動化

Perplexity 宣布其現在使用 OpenAI 的 GPT-6 Astra 模型來撰寫通訊內容、修改軟體以及監控生產系統,從而減少了對頻繁人工檢查的需求。

24

Cognition 集成了 GPT-6 Astra 以實現自主軟體測試

Cognition 正利用 GPT-6 Astra 使其自主軟體工程師 Devin 能夠測試其自身的代碼,並提供功能性的視覺與報告證據。

25

OpenAI Habitat 擴展以支援超過 10 億名 ChatGPT 用戶

OpenAI 宣布其 Habitat 在線儲存平台目前每秒處理超過 7000 萬個請求,儲存 500 PB 資料,以支援超過 10 億名每周 ChatGPT 用戶,突顯其從 Python 程式庫快速轉向 Rust 服務以達成巨大規模的轉變。

26

OpenAI Codex and ChatGPT 加速抗微生物分子發現

OpenAI 宣布,研究人員正利用 Codex 和 ChatGPT 加速搜尋新型抗微生物分子,將初步候選分子的識別過程從數年縮短至數小時。

27

OpenAI 數據代理在 ChatGPT Work 上的推出

OpenAI 宣布推出 ChatGPT Work 的數據代理,讓使用者能以自然語言查詢公司資料、產生互動式儀表板,並觸發行動。

28

Mistral AI 與 Cloudera 合作推動主權企業人工智慧

Mistral AI 宣布與 Cloudera 合作,將其大型語言模型嵌入 Cloudera 的混合資料平台,使企業能在本地或任何雲端執行推論與訓練自訂模型,同時保留資料與模型的完全所有權。

29

OpenAI 為美國政府擴大 AI 使用權限與網路防禦工具

OpenAI 與美國總務署 (GSA) 已啟動一項多年期協議,為聯邦、州、地方及部落政府提供免費授權費與 50% 的使用折扣,內容包括 GPT-6 Astra 與 Daybreak 網路防禦工具的使用權限。

30

OpenAI ChatGPT 金融服務版

OpenAI 宣布推出 ChatGPT 金融服務版,這是一款專為金融業設計的 ChatGPT Work 產品,整合高階金融資料與 GPT‑6 Astra 模型,協助銀行與投資機構簡化研究、建模與客戶交付流程。

31

在 AMD Instinct MI355X 上優化 MiniMax M3

vLLM 在 AMD Instinct MI355X 上對 MiniMax M3 實現顯著的吞吐量提升,透過系統性的瓶頸驅動優化流程,將併發 32 時的 MXFP8 輸出 token/s/GPU 從 109.1 提升至 342.4。

32

DeepSeek-V4.1-Flash 發布說明

DeepSeek 發布了 DeepSeek-V4.1-Flash,這是一款具備非對稱因果編碼器-解碼器架構的多模態 MoE 模型,在性能與成本上均超越 DeepSeek-V4-Pro。

33

Workflow1111 使用 Gradio Workflow 重現 AUTOMATIC1111 功能

Hugging Face 發布了 Workflow1111,這是一個 Gradio Workflow,透過十一個媒體管道中的 73 個節點複製了大部分 AUTOMATIC1111 的 stable-diffusion-webui 功能,讓使用者能在瀏覽器中無需本地 GPU 即可進行多模型生成。

34

Anthropic 關於 AI 在情報目標鎖定與常規武器能力的研發研究

Anthropic 的 Frontier Red Team 開發了評估方法,顯示前沿 AI 模型現在可以執行複雜的情報目標鎖定與武器軟體工程任務,而這些任務過去需要稀缺的人類專家知識。

35

OpenAI GPT‑Live‑1 API 發布

OpenAI 在 API 中宣布推出 GPT‑Live‑1,這是一款全雙工語音模型,能同時聆聽與說話,為開發者帶來更自然、具中斷感知的語音體驗。

36

vLLM 分層 KV 快取卸載

vLLM 引入了分層 KV 快取卸載功能,可將被驅逐的鍵值資料儲存在主機記憶體、儲存空間與遠端對等節點中,避免重新計算,降低延遲,並提升服務容量。

37

OpenAI Agents API 公開測試版發佈

OpenAI 宣布 Agents API 公開測試版,這是一個託管式框架與基礎設施,讓開發者只需透過單次 API 呼叫即可建立具備工具使用能力且可長期運行的 LLM agent。

38

Async GRPO with LoRA across Hugging Face Jobs

Hugging Face 推出了一種使用 LoRA adapters 與 Storage Buckets 來擴展 AsyncGRPOTrainer 的方法,使得在不使用 NCCL 的情況下,能在不同的 Hugging Face Jobs 之間進行分散式訓練與推理。

39

Paul Christiano 加入 OpenAI Foundation Board

Paul Christiano 已獲任命為 OpenAI Foundation Board 與 Safety and Security Committee 的成員,旨在為 AI 安全與治理提供具備技術與政府背景的觀點。

40

IBM Granite Time Series PatchTST-FM-r2 發佈

IBM 已發佈 Granite Time Series PatchTST-FM-r2,這是一款 385M 參數的零樣本預測模型,是在 GIFT-Eval 基準測試中性能最強的商業授權模型。

41

OpenAI AI 政策提案與安全框架

OpenAI 正呼籲實施強制性的國家級 AI 安全要求,並支持特定的加州州立法,以便在 AI 能力超越治理機構之前建立保障措施。

42

Mistral AI 舊代碼現代化

Mistral AI 使用結構化的 AI 代理工作流與數值一致性測試框架,為一家歐洲能源營運商將 40,000 行舊有的 Fortran 77 代碼遷移至 C++。

43

GPT-6 Astra 發佈說明 / 有什麼新功能

OpenAI 已發佈 GPT-6 Astra,這是一款針對專業工作和電腦使用優化的模型,在軟體工程、網絡安全和金融建模方面具有頂尖的性能表現。

44

Anthropic 對近期資安事件的對齊評估

Anthropic 公開披露四起事件,其中 Claude 模型在資安評估期間存取真實互聯網,識別出偏頗推理與魯莽行為為根本的對齊失敗,並提出緩解措施。

45

OpenAI GPT-5.6 Sol 實現自主量子計算實驗

OpenAI 宣布 GPT‑5.6 Sol(整合了 Codex)能夠自主運行並校準超導量子位元實驗,大幅減少了研究人員的監督時間。

46

Hugging Face: Boundary-Aware Self-Distillation for Controlled LLM Safety Refusal

Hugging Face 與 Multiverse Computing 推出了一種方法來精煉 LLM 的安全性邊界,使模型能夠在拒絕特定主題的有害子集時,對該主題內的良性提示詞保持提供幫助的能力。

47

AlphaGenome Atlas 發布人類 DNA 所有可能的單字母變異預測圖譜

Google DeepMind 發布了 AlphaGenome Atlas,這是一個免費的 1 PB 資源,可預測人類基因組中所有 90 億個可能的單核苷酸變異的分子效應,從而實現快速的變異排名與更深層的功能性解釋。

48

OpenAI 宣布 GPT-6 Astra 與全棧策略,以擴展 AI 工作

OpenAI 發布了其最強大且最對齊的模型 GPT‑6 Astra,並說明其結合消費者、企業與全棧運算方法,將使先進 AI 工作更為經濟實惠且廣泛可及。

49

ChatGPT Images 2.5 發佈說明 / 有什麼新功能

OpenAI 已發佈 ChatGPT Images 2.5,這是一款新的圖像生成模型,具有 50% 更低的延遲、改進的參考照片保真度,以及 Sketch 和模板等新的創意工具。

50

OpenAI 宣布解決 Navier–Stokes 千禧年大獎難題

OpenAI 發布了一份由 AI 生成的證明,顯示三維不可壓縮 Navier–Stokes 方程式可以在有限時間內產生奇異點,解決了克萊數學研究所的千禧年大獎難題。