封存 · 11 個實驗室 · 3,049 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

651

使用 vLLM x Mooncake 大規模服務 Agentic 工作負載

vLLM 整合 Mooncake 的分散式 KV 快取存儲,以提升 Agentic LLM 服務,在真實追蹤上提供 3.8× 更高的吞吐量、46× 降低的 TTFT 與 8.6× 降低的端到端延遲,同時擴展至 60 個 GB200 GPU。

652

Hugging Face 開放 ASR 排行榜:私有資料集以對抗 Benchmaxxing

Hugging Face 已將 Appen Inc. 與 DataoceanAI 的私有評估資料集加入 Open ASR Leaderboard,以防止測試集污染,並提供更具韌性的真實世界 ASR 效能衡量。

653

OpenAI B2B Signals: 領先企業如何拉開距離

OpenAI 推出 B2B Signals 以揭示領先企業——即使用量在第 95 個百分位的企業——現在每位員工使用的智能量是典型企業的 3.5 倍,這是由複雜的、具代理特性的工作流程驅動的。

654

OpenAI 推出 ChatGPT Futures:2026 屆

OpenAI 已推出 ChatGPT Futures,這是一項為 2026 屆使用 AI 建構工具、推進研究並創造社會影響的學生提供資助與模型存取的計畫。

655

Singular Bank 整合 ChatGPT 與 Codex 推出 Singularity 助理

Singular Bank 開發了 Singularity,一款由 ChatGPT 與 Codex 驅動的內部 AI 助理,透過自動化投資組合分析與溝通,使銀行家每日節省 60 至 90 分鐘的生產力損失。

656

Uber 與 OpenAI 整合:AI 驅動的司機指導與語音預訂

Uber 正整合 OpenAI 前沿模型,推出 Uber Assistant 以優化司機收入並提供語音叫車功能,降低乘客使用摩擦。

657

Grok Imagine Quality Mode API 發佈

xAI 已為 Grok Imagine API 推出 Quality Mode,為企業開發者提供增強的寫實度、改進的多語言文字渲染,以及在圖像生成與編輯方面卓越的創意控制能力。

658

xAI Grok Connectors 發佈

xAI 已推出 Connectors,這是針對 Grok 在 Web、iOS 和 Android 上的深度整合功能,讓 AI 能夠在 Google Workspace、GitHub 和 Notion 等第三方應用程式中讀取與寫入資料。

659

xAI 與 Anthropic 的運算合作夥伴關係

xAI 已與 Anthropic 合作提供 Colossus 1 超級電腦的使用權限,並有進一步計畫探索軌道 AI 運算能力。

660

Anthropic 透過與 SpaceX 合作擴展運算能力並提高 Claude 使用限制

Anthropic 已與 SpaceX 建立合作夥伴關係,以使用 Colossus 1 資料中心,從而實現 Claude Code 和 Claude API 更高的使用限制。

661

GPT-5.5 Instant 系統卡

OpenAI 已發布 GPT-5.5 Instant 系統卡,標誌著 Instant 模型首次在「網路安全」與「生物與化學防護」類別被歸類為高能力。

662

GPT-5.5 Instant 版本說明 / 新功能概覽

OpenAI 已發布 GPT-5.5 Instant,作為 ChatGPT 的新預設模型,提升了事實準確性、減少冗長回覆,並透過更深入的使用者情境整合加強個人化。

663

OpenAI MRC 多路徑可靠連接協議

OpenAI 透過 Open Compute Project 發布了多路徑可靠連接(MRC)協議,以提升大型 AI 訓練叢集中的 GPU 網路韌性與效能。

664

OpenAI 歐洲青年安全藍圖與 EMEA 青年福祉補助金

OpenAI 宣布了其歐洲青年安全藍圖以及首批 EMEA 青年福祉補助金的受助者,以促進適齡 AI 使用並保護歐洲、中東與非洲的年輕人。

665

OpenAI 擴大 ChatGPT 廣告試點,推出自助廣告管理平台與每次點擊付費 (CPC) 出價

OpenAI 正在擴大其 ChatGPT 廣告試點,推出測試版自助廣告管理平台、每次點擊付費 (CPC) 出價以及擴充的測量工具,讓各種規模的企業都能更容易投放廣告。

666

OpenAI 與 PwC 在金融領域的 AI 代理人合作

OpenAI 與 PwC 正在合作部署可自動化金融工作流程的 AI 代理人,並以 OpenAI 自身的財務組織作為測試平台,以現代化 CFO 辦公室。

667

OpenAI 低延遲語音 AI 基礎設施

OpenAI 重新設計了其 WebRTC 架構,採用分離的中繼加收發器(relay‑plus‑transceiver)架構,以向超過 9 億每週活躍使用者提供低延遲、可擴展的語音 AI。

668

Anthropic 與 Blackstone、Hellman & Friedman 及 Goldman Sachs 成立新的企業 AI 服務公司

Anthropic 與 Blackstone、Hellman & Friedman 及 Goldman Sachs 合作,推出一家新的 AI 服務公司,專注於為中型組織部署 Claude。

669

Google DeepMind AI 共同臨床醫師研究計畫

Google DeepMind 已推出 AI 共同臨床醫師研究計畫,這是一個多模態 AI 系統,旨在透過證據綜合和在臨床監督下的即時患者互動來支援醫療提供者。

670

Qwen-Scope 可解釋性工具包發布

Qwen 發布了 Qwen-Scope,一款使用稀疏自編碼器(SAE)將 Qwen3 與 Qwen3.5 模型的隱藏表示分解為可解釋特徵,以進行模型優化的可解釋性工具包。

671

OpenAI 高級帳戶安全發布

OpenAI 推出高級帳戶安全,這是一項可選設定,適用於 ChatGPT 與 Codex 帳戶,要求使用防釣魚驗證並停用傳統的恢復方式,以保護高風險使用者。

672

Anthropic Claude 個人指導研究揭示使用模式,並在 Opus 4.7 與 Mythos Preview 中降低奉承行為

Anthropic 宣布,約有 6% 的 Claude 對話屬於個人指導請求,而新推出的 Opus 4.7 與 Mythos Preview 模型將奉承回應減半,特別是在人際關係建議方面。

673

xAI 自訂語音發布

xAI 推出自訂語音功能,讓使用者可從短時間錄音中克隆個人語音,並應用於 Grok 文字轉語音與語音代理 API。

674

OpenAI 模型行為分析:'Goblin' 詞彙抽搐

OpenAI 發現,針對「Nerdy」個性功能的獎勵訊號導致 GPT-5.1 至 GPT-5.5 的模型產生了使用 goblin 與 gremlin 隱喻的非預期習慣,且此習慣進一步在其他模型行為中泛化。

675

IBM Granite 4.1 LLMs 發行說明 / 技術概覽

IBM 已發布 Granite 4.1,這是一系列密集型、僅解碼器的 LLMs(3B、8B 和 30B),透過嚴謹的資料策劃和多階段強化學習管線來實現高效能。

676

OpenAI Stargate 計算基礎設施更新

OpenAI 已超越其在美國的 10GW AI 基礎設施初始目標,並在其位於德克薩斯州阿比林的旗艦 Stargate 站點訓練了 GPT-5.5。

677

OpenAI 資訊時代網路安全行動計畫

OpenAI 已推出一項五大支柱的行動計畫,以民主化 AI 驅動的網路防禦,並增強對 AI 驅動威脅的韌性。

678

DeepInfra 與 Hugging Face 推理提供者整合

Hugging Face 已將 DeepInfra 加入為支援的推理提供者,使開發者能直接透過 Hub 和用戶端 SDK 存取超過 100 個模型(包括 DeepSeek V4 和 Kimi-K2.6)的無伺服器推理。

679

使用 BioMysteryBench 評估 Claude 的生物資訊學研究能力

Anthropic 推出 BioMysteryBench,這是一個新的生物資訊學基準,最新版的 Claude 模型表現與人類專家相當,並解決了多個人類專家無法解決的問題。

680

NVIDIA Nemotron 3 Nano Omni 發佈說明 / 新功能介紹

NVIDIA 已發佈 Nemotron 3 Nano Omni,這是一款能夠跨文字、圖像、影片和音訊進行長上下文推理的全模態模型,在文檔智能和影片理解基準測試中提供了業界領先的準確度。

681

FlashQLA:適用於 CP / 反向傳播的融合線性注意力核心(針對 GDN)

Qwen 已開源 FlashQLA,這是一個基於 TileLang 的高效能線性注意力核心庫,能在 NVIDIA Hopper GPU 上為門控增量網路(GDN)層提供 2‑3 倍的前向與 2 倍的反向加速。

682

vLLM 中對 NVIDIA Nemotron 3 Nano Omni 的支援

vLLM 現已支援 NVIDIA Nemotron 3 Nano Omni,這是一款高效的 30 億參數 MoE 多模態模型,能在單一迴圈中統合視覺、音訊與語言推理,以驅動代理式 AI。

683

OpenAI 社群安全與暴力緩減框架

OpenAI 已詳細說明其多層次方法,以防止將 ChatGPT 用於規劃或執行暴力,結合模型訓練、自動偵測與人工審查。

684

OpenAI GPT-5.5、Codex 與 AWS 上的受管代理發布說明

2026年4月28日,OpenAI 宣佈其前沿模型(包括 GPT-5.5、Codex 程式碼代理以及由 OpenAI 提供動力的 Amazon Bedrock 受管代理)現已在 AWS 上以有限預覽方式提供,讓企業能在現有的 AWS 安全、合規與採購工作流程中使用這些功能。

685

OpenAI 獲得 FedRAMP Moderate 授權

OpenAI 已取得 ChatGPT Enterprise 與其 API 平台的 FedRAMP 20x Moderate 授權,使美國政府機構能在符合聯邦安全與隱私標準的前提下存取包括 GPT-5.5 在內的前沿 AI 模型。

686

Mistral AI Workflows 公開預覽

Mistral AI 已發布 Workflows 公開預覽版,為企業 AI 提供了一個編排層,確保生產環境 AI 流程的持久性、可觀測性與容錯能力。

687

TITLE: Google DeepMind 與韓國的合作

SUMMARY: Google DeepMind 已與韓國科學與資訊通訊部合作,在首爾設立 AI 校園並部署前沿 AI 模型,以加速生命科學、能源與氣候領域的科學研究。

688

微軟與 OpenAI 合作的下一階段

OpenAI 與微軟已修改合作協議,以提供更大的彈性,允許 OpenAI 在任何雲端服務提供商上提供產品,同時仍將微軟作為其主要雲端合作夥伴。

689

# Choco 使用 AI 代理自動化食品分銷

Choco 宣布使用 OpenAI API 構建的 AI 驅動的 OrderAgent 和 VoiceAgent,以自動化食品分銷訂單處理。

690

# OpenAI 隱私過濾器:構建可擴展的 PII 偵測網頁應用

OpenAI 已發布 Privacy Filter,一個開源的 1.5B 參數 PII 偵測器,能夠在 128k 上下文窗口內標記八種類別的敏感資料。

691

Symphony: Codex 編排的開源規範

OpenAI 發布了 Symphony,這是一個開源規範,將 Linear 等問題追蹤器轉化為 Codex 編碼代理的常駐編排器,使團隊能夠自動化常規實作工作並提高 PR 吞吐量。

692

OpenAI 通用人工智慧 (AGI) 開發的運營原則

OpenAI 已概述五項核心原則——民主化、能力賦予、韌性、普惠繁榮與適應性——以確保通用人工智慧 (AGI) 惠及全人類。

693

OpenAI AI 工作過渡框架

OpenAI 已推出 AI 工作過渡框架,以分析 AI 對 921 個職業的就業影響,根據自動化風險、重組、成長潛力和穩定性將工作分為四條路徑。

694

vLLM DeepSeek V4 支援:高效長上下文注意力

vLLM 現已支援 DeepSeek V4-Pro 與 V4-Flash,實作了一種新注意力機制,使上下文長度可達一百萬個 token,並大幅節省 KV cache 記憶體。

695

DeepSeek-V4 發佈說明:為 AI Agents 提供高效的 1M-Token 上下文

DeepSeek-V4 引入了由混合 CSA/HCA 注意力機制驅動的 1M-token 上下文窗口,專為長時程代理工作負載和工具使用軌跡進行了優化。

696

DeepSeek-V4 Preview Release

DeepSeek 已發佈開源的 DeepSeek-V4 preview,推出了兩種模型變體——Pro 與 Flash——具備 1M token 上下文窗口與尖端的 agentic coding 能力。

697

Anthropic 與 NEC 在日本建立 AI 原生工程夥伴關係

Anthropic 與 NEC 已建立夥伴關係,將 Claude 部署至 30,000 名 NEC 員工,並為日本金融、製造及政府部門開發安全且具備特定產業能力的 AI 產品。

698

Anthropic 選舉保障措施更新

Anthropic 已實施了一套全面的保障措施,包括中立性訓練與自動化分類器,以確保 Claude 在 2026 年美國中期選舉及其他全球選舉期間保持公正與安全。

699

OpenAI GPT-5.5 版本說明

OpenAI 已發布 GPT-5.5 與 GPT-5.5 Pro,於代理式程式編寫、電腦使用與科學研究方面帶來重大進步,同時保持 GPT-5.4 的延遲表現。

700

# OpenAI GPT-5.5 系統卡

OpenAI 已發布 GPT-5.5,這是一個針對複雜現實世界任務和工具使用進行優化的模型,具備增強的任務理解能力以及更穩固的安全框架。