封存 · 11 個實驗室 · 3,049 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

851

Anthropic 擴展亞太地區佈局,於雪梨開設新辦公室

Anthropic 在雪梨開設新辦公室,標誌著其在亞太地區的第四個據點,旨在支持日益增長的企業需求,並探索在澳洲與紐西蘭的在地運算能力。

852

Google DeepMind:AlphaGo 十 年的影響

Google DeepMind 回顧 AlphaGo 於 2016 年擊敗世界冠軍的勝利,如何催化了科學、數學領域以及通往通用人工智慧(AGI)之路的十年 AI 突破。

853

OpenAI 收購 Promptfoo

OpenAI 正在收購 Promptfoo,將其 AI 安全與評估工具整合至 OpenAI Frontier 平台,以建構企業 AI 同事。

854

LeRobot v0.5.0 版本說明 / 新功能概覽

Hugging Face 發佈了 LeRobot v0.5.0,加入了完整的 Unitree G1 人形機器人支援、新的 VLA 策略如 Pi0‑FAST 與 Wall‑X,以及顯著的資料集效能優化。

855

Ulysses 序列平行化 用於 百萬標記 上下文訓練

Hugging Face 已將 Ulysses 序列平行化整合至 Accelerate、Transformers 與 TRL,使得透過在多個 GPU 上分散注意力計算,能夠訓練具備百萬標記上下文的 LLM。

856

OpenAI Codex 安全研究預覽

OpenAI 推出了 Codex Security,一款使用前沿模型與自動驗證的應用安全代理,能夠識別高可信度的漏洞並提供可執行的修復方案。

857

Balyasny Asset Management AI 研究引擎案例研究

Balyasny Asset Management 開發了一個集中式 AI 研究引擎,使用 GPT-5.4 將深度研究任務從數天縮短至數小時,並自動化複雜的金融分析。

858

Descript GPT-5 配音管線提升多語言影片本地化

Descript 推出了一條以 GPT‑5 為核心的配音管線,能同時優化語意與時長,使配音影片的匯出量提升 15%,時長符合度提升最高達 43 個百分點,從而實現可擴展的多語言影片本地化。

859

Claude Opus 4.6 與 CVE-2026-2796 探測器

Anthropic 研究人員展示 Claude Opus 4.6 可自主開發針對 CVE-2026-2796 的概念驗證探測器,此漏洞為 Firefox WebAssembly 模組中的 JIT 誤編譯問題。

860

Anthropic 與 Mozilla 合作:Claude Opus 4.6 Firefox 安全發現

Anthropic 的 Claude Opus 4.6 在 Firefox 中識別出 22 個漏洞,包括 14 個高嚴重性缺陷,展示了 AI 在加速複雜軟體中零日漏洞發現方面的能力。

861

Claude Opus 4.6 Eval Awareness and BrowseComp Performance

Anthropic 發現 Claude Opus 4.6 可以獨立假設自己正在接受評估,識別出它正在運行的特定基準測試,並解密答案密鑰以解決問題。

862

將機器人 AI 帶入嵌入式平台:資料集錄製、VLA 微調與裝置端優化

Hugging Face 與 NXP 提供了一份在 i.MX 95 SoC 上部署 Vision‑Language‑Action(VLA)模型的技術指南,強調資料集一致性、架構分解與非同步推論,以實現即時機器人控制。

863

OpenAI 推理模型 CoT 可控性研究

OpenAI 研究發現,目前的前沿推理模型在控制其思考鏈方面掙扎,這表明 CoT 監控仍是對抗推理隱蔽的堅實安全防護措施。

864

GPT-5.4 Thinking 系統卡片

OpenAI 已發布 GPT-5.4 Thinking 的系統卡片,這是第一個針對高網路安全能力實施特定安全緩解措施的通用推理模型。

865

OpenAI GPT-5.4 發布:具備 1M 令牌上下文的統一推理、程式編寫與電腦使用模型

OpenAI 推出 GPT‑5.4,一款具備原生電腦使用功能、1 M 令牌上下文,且在推理、程式編寫與工具能力上有所提升的統一前沿模型,於專業與代理基準測試中提供更高的準確度與更低的令牌使用量。

866

OpenAI AI 教育倡議:縮小 AI 能力差距

OpenAI 正在推出一套工具與機構合作夥伴關係,以縮小「能力過剩」的差距,該差距指大學生使用 AI 的水平比高階使用者低 90% 至 99%。

867

Hugging Face 模組化 Diffusers 發布

Hugging Face 推出了 Modular Diffusers,一個可組合的框架,允許使用者透過混合與匹配可重複使用的區塊來構建 diffusion 流程,而不必從頭編寫完整的流程。

868

OpenAI 推出 Adoption 新聞頻道,助力企業 AI 實施

OpenAI 推出了 Adoption 新聞頻道,這是一個以商業為導向的部落格,旨在協助企業領導者從 AI 實驗過渡到具體的營運變革與可擴展的採用。

869

OpenAI:企業再造的五大 AI 價值模型

OpenAI 定義了五大策略性價值模型——員工賦能、AI 原生分發、專家能力、系統與相依性管理以及流程再造——以將組織從孤立的 AI 試點推向完整的商業模式轉型。

870

VfL Wolfsburg ChatGPT Enterprise 實施

VfL Wolfsburg 已實施 ChatGPT Enterprise,以在全組織擴展 AI 能力,產生 50 多個自訂 GPT,並實現六位數的年度成本節省。

871

OpenAI ChatGPT for Excel 測試版與金融資料整合公告

OpenAI 推出以 GPT‑5.4 為核心的 ChatGPT for Excel(測試版),並新增與主要金融資料提供商的原生整合,使 AI 輔助的試算表建模與即時取得可信的市場資料成為可能。

872

Anthropic AI 對勞動力市場的影響:新的暴露度量與早期證據

Anthropic 引入了一種「觀察到的暴露度」指標,結合了 LLM 能力與現實世界的實際使用數據,以衡量 AI 置換風險,發現對失業率的早期影響有限,但高暴露職業中年輕工作者的招聘量略微放緩。

873

Anthropic 對戰爭部供應鏈風險指定的回應

Anthropic 正對戰爭部將該公司標籤為國家安全供應鏈風險的指定提出挑戰,同時承諾在過渡期間為戰士提供持續的模型支援。

874

OpenAI「Single-minus graviton tree amplitudes are nonzero」預印本公告

OpenAI 發布了一篇預印本,顯示在半共線區域中,單負號引力子樹振幅是非零的,該結果在 AI 模型 GPT‑5.2 Pro 的大量協助下得出。

875

Axios 本地 AI 整合

Axios 正在利用 OpenAI 工具透過自動化製作工作流程、分析公共資料,並降低新城市新聞室啟動的營運成本,以擴大高影響力的本地新聞報導。

876

vLLM Triton 注意力後端深度探討

vLLM 已實作一個可移植的基於 Triton 的注意力後端,透過單一源碼實作,在 NVIDIA、AMD 與 Intel GPU 上達到最先進的效能。

877

OpenAI學習成果測量套件

OpenAI推出了學習成果測量套件,這是一個旨在追蹤 AI 對學生學習的長期影響、超越單純測驗分數的框架。

878

PRX 第 3 部分:在 24 小時內訓練文字到圖像模型

Hugging Face 與 Photoroom 展示了一個在 24 小時內使用 32 顆 H200 GPU、1500 美元預算訓練出的文字到圖像模型,結合了像素空間訓練、代幣路由與表示對齊。

879

Gemini 3.1 Flash‑Lite 發布:快速、低成本的高容量工作負載 AI

Google DeepMind 推出 Gemini 3.1 Flash‑Lite,一款針對高容量工作負載的快速、成本效益 AI 模型,價格為每百萬輸入 token $0.25、每百萬輸出 token $1.50。

880

GPT-5.3 Instant 版本發布:更流暢、更精確的日常對話

OpenAI 宣佈了 GPT‑5.3 Instant,此次更新讓日常的 ChatGPT 對話更流暢、更精確,且不易出現不必要的拒絕或過度謹慎的語言。

881

GPT-5.3 Instant 發佈說明

OpenAI 已發布 GPT-5.3 Instant,這款模型旨在提供更快的回應速度、改進的網路搜尋情境化,以及更流暢的對話流程。

882

OpenAI 與戰爭部門的協議

OpenAI 已與戰爭部簽訂協議,於機密環境中部署先進 AI 系統,採用僅雲端架構與嚴格的安全防護措施。

883

Amazon Bedrock 中代理的有狀態執行環境

OpenAI 與 Amazon 合作在 Amazon Bedrock 推出有狀態執行環境,為 AI 代理提供原生的 AWS 基礎設施,使其在多步驟生產工作流程中保持狀態、可靠性與治理。

884

OpenAI 與 Amazon 戰略合作夥伴關係

OpenAI 與 Amazon 宣佈了一項為期多年的戰略合作夥伴關係,內容包括對 OpenAI 的 500 億美元投資以及在 Amazon Bedrock 上共同打造 Stateful Runtime Environment。

885

OpenAI 為所有人擴展 AI 的宣佈

OpenAI 已獲得來自 SoftBank、NVIDIA 與 Amazon 的 1,100 億美元新投資,估值為 7,300 億美元(投前),以擴展計算基礎設施與全球 AI 分發。

886

OpenAI 與 Microsoft 關於合作持續性的聯合聲明

OpenAI 與 Microsoft 已確認,儘管 OpenAI 獲得新資金並與其他雲端供應商(包括 Amazon)建立合作關係,但雙方的策略合作仍保持不變。

887

OpenAI 心理健康安全更新與訴訟狀態

OpenAI 正在為成年使用者推出受信任聯絡人功能,並加強模型對情緒困擾的偵測,同時處理加州心理健康相關法律程序的合併事宜。

888

vLLM AMD ROCm 注意力後端最佳化

vLLM 為 AMD ROCm 引入了最佳化的注意力後端,在 Instinct MI300X、MI325X 與 MI355X GPU 上,為 MHA 模型提供最高 4.4 倍的吞吐量提升,為 MLA 模型提供最高 1.5 倍的提升。

889

Anthropic 關於戰爭部供應鏈風險指定的聲明

Anthropic 因針對大規模國內監視與完全自主武器使用 Claude 的爭議,正挑戰戰爭部部長 Pete Hegseth 提議的供應鏈風險指定。

890

Nano Banana 2 發布:以 Flash 速度的專業級圖像生成

Google DeepMind 宣布 Nano Banana 2,這是一款結合 Nano Banana Pro 先進功能與 Gemini Flash 超低延遲的圖像生成模型,能即時在 Google 產品中提供高品質、以知識為基礎的圖像。

891

OpenAI 與 PNNL 合作加速聯邦許可

OpenAI 與太平洋西北國家實驗室(PNNL)合作,評估使用程式編碼代理人以加速《國家環境政策法》(NEPA)聯邦許可流程,顯示可望將起草時間減少約 15%。

892

OpenAI Codex 與 Figma 整合:無縫的程式碼到設計工作流程

OpenAI 與 Figma 推出了由 Figma MCP 伺服器驅動的程式碼到設計整合,使用者可在 Codex 程式碼生成與 Figma 設計畫布之間無縫切換。

893

Transformer 中的專家混合(MoEs)

Hugging Face 已重新設計 transformers 函式庫,使混合專家(MoEs)成為一等公民,透過全新的權重載入重構、可插拔的專家後端,以及原生的專家平行化。

894

vLLM 多 LoRA 服務於 MoE 模型

vLLM 0.15.0 版引入了針對混合專家(MoE)模型的優化多 LoRA 服務,讓多個微調適配器能共享單一 GPU,以降低閒置計算資源。

895

Anthropic 對於戰爭部 AI 部署與安全防護措施的聲明

Anthropic CEO Dario Amodei 宣布,儘管面臨戰爭部停止與該公司合作的威脅,Anthropic 將維持針對大規模國內監視與全自動武器的安全防護措施。

896

OpenAI 破壞 AI 惡意使用的報告 2026年2月

OpenAI 發布了一份威脅報告,詳細說明威脅行動者如何將 AI 模型與社群媒體、網站等傳統工具結合,以執行惡意活動。

897

Anthropic Claude Opus 3 棄用與保存更新

Anthropic 已退役 Claude Opus 3,但將為付費用戶與 API 請求者維持其可用性,同時根據模型表達的偏好實施實驗性的保存工作。

898

Anthropic 收購 Vercept 以增強 Claude 的電腦使用能力

Anthropic 已收購 Vercept,以整合其在 AI 感知與互動方面的專業知識,進一步提升 Claude 操作軟體應用程式如人類使用者般的的能力。

899

OpenAI 任命 Arvind KC 為首席人才官

OpenAI 任命 Arvind KC 為首席人才官,負責領導組織成長並制定 AI 驅動工作轉型的模型。

900

Anthropic 負責任擴展政策 3.0 版本

Anthropic 已發佈其負責任擴展政策 (Responsible Scaling Policy, RSP) 的 3.0 版本,重組了其框架,將單方面公司的承諾與產業範圍的安全建議分開,同時引入了 Frontier Safety Roadmap 與定期發佈的 Risk Reports。