✷ 封存 · 11 個實驗室 · 3,049 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
使用 vLLM x Mooncake 大規模服務 Agentic 工作負載
vLLM 整合 Mooncake 的分散式 KV 快取存儲,以提升 Agentic LLM 服務,在真實追蹤上提供 3.8× 更高的吞吐量、46× 降低的 TTFT 與 8.6× 降低的端到端延遲,同時擴展至 60 個 GB200 GPU。
Hugging Face 開放 ASR 排行榜:私有資料集以對抗 Benchmaxxing
Hugging Face 已將 Appen Inc. 與 DataoceanAI 的私有評估資料集加入 Open ASR Leaderboard,以防止測試集污染,並提供更具韌性的真實世界 ASR 效能衡量。
OpenAI B2B Signals: 領先企業如何拉開距離
OpenAI 推出 B2B Signals 以揭示領先企業——即使用量在第 95 個百分位的企業——現在每位員工使用的智能量是典型企業的 3.5 倍,這是由複雜的、具代理特性的工作流程驅動的。
OpenAI 推出 ChatGPT Futures:2026 屆
OpenAI 已推出 ChatGPT Futures,這是一項為 2026 屆使用 AI 建構工具、推進研究並創造社會影響的學生提供資助與模型存取的計畫。
Singular Bank 整合 ChatGPT 與 Codex 推出 Singularity 助理
Singular Bank 開發了 Singularity,一款由 ChatGPT 與 Codex 驅動的內部 AI 助理,透過自動化投資組合分析與溝通,使銀行家每日節省 60 至 90 分鐘的生產力損失。
Uber 與 OpenAI 整合:AI 驅動的司機指導與語音預訂
Uber 正整合 OpenAI 前沿模型,推出 Uber Assistant 以優化司機收入並提供語音叫車功能,降低乘客使用摩擦。
Grok Imagine Quality Mode API 發佈
xAI 已為 Grok Imagine API 推出 Quality Mode,為企業開發者提供增強的寫實度、改進的多語言文字渲染,以及在圖像生成與編輯方面卓越的創意控制能力。
xAI Grok Connectors 發佈
xAI 已推出 Connectors,這是針對 Grok 在 Web、iOS 和 Android 上的深度整合功能,讓 AI 能夠在 Google Workspace、GitHub 和 Notion 等第三方應用程式中讀取與寫入資料。
xAI 與 Anthropic 的運算合作夥伴關係
xAI 已與 Anthropic 合作提供 Colossus 1 超級電腦的使用權限,並有進一步計畫探索軌道 AI 運算能力。
Anthropic 透過與 SpaceX 合作擴展運算能力並提高 Claude 使用限制
Anthropic 已與 SpaceX 建立合作夥伴關係,以使用 Colossus 1 資料中心,從而實現 Claude Code 和 Claude API 更高的使用限制。
GPT-5.5 Instant 系統卡
OpenAI 已發布 GPT-5.5 Instant 系統卡,標誌著 Instant 模型首次在「網路安全」與「生物與化學防護」類別被歸類為高能力。
GPT-5.5 Instant 版本說明 / 新功能概覽
OpenAI 已發布 GPT-5.5 Instant,作為 ChatGPT 的新預設模型,提升了事實準確性、減少冗長回覆,並透過更深入的使用者情境整合加強個人化。
OpenAI MRC 多路徑可靠連接協議
OpenAI 透過 Open Compute Project 發布了多路徑可靠連接(MRC)協議,以提升大型 AI 訓練叢集中的 GPU 網路韌性與效能。
OpenAI 歐洲青年安全藍圖與 EMEA 青年福祉補助金
OpenAI 宣布了其歐洲青年安全藍圖以及首批 EMEA 青年福祉補助金的受助者,以促進適齡 AI 使用並保護歐洲、中東與非洲的年輕人。
OpenAI 擴大 ChatGPT 廣告試點,推出自助廣告管理平台與每次點擊付費 (CPC) 出價
OpenAI 正在擴大其 ChatGPT 廣告試點,推出測試版自助廣告管理平台、每次點擊付費 (CPC) 出價以及擴充的測量工具,讓各種規模的企業都能更容易投放廣告。
OpenAI 與 PwC 在金融領域的 AI 代理人合作
OpenAI 與 PwC 正在合作部署可自動化金融工作流程的 AI 代理人,並以 OpenAI 自身的財務組織作為測試平台,以現代化 CFO 辦公室。
OpenAI 低延遲語音 AI 基礎設施
OpenAI 重新設計了其 WebRTC 架構,採用分離的中繼加收發器(relay‑plus‑transceiver)架構,以向超過 9 億每週活躍使用者提供低延遲、可擴展的語音 AI。
Anthropic 與 Blackstone、Hellman & Friedman 及 Goldman Sachs 成立新的企業 AI 服務公司
Anthropic 與 Blackstone、Hellman & Friedman 及 Goldman Sachs 合作,推出一家新的 AI 服務公司,專注於為中型組織部署 Claude。
Google DeepMind AI 共同臨床醫師研究計畫
Google DeepMind 已推出 AI 共同臨床醫師研究計畫,這是一個多模態 AI 系統,旨在透過證據綜合和在臨床監督下的即時患者互動來支援醫療提供者。
Qwen-Scope 可解釋性工具包發布
Qwen 發布了 Qwen-Scope,一款使用稀疏自編碼器(SAE)將 Qwen3 與 Qwen3.5 模型的隱藏表示分解為可解釋特徵,以進行模型優化的可解釋性工具包。
OpenAI 高級帳戶安全發布
OpenAI 推出高級帳戶安全,這是一項可選設定,適用於 ChatGPT 與 Codex 帳戶,要求使用防釣魚驗證並停用傳統的恢復方式,以保護高風險使用者。
Anthropic Claude 個人指導研究揭示使用模式,並在 Opus 4.7 與 Mythos Preview 中降低奉承行為
Anthropic 宣布,約有 6% 的 Claude 對話屬於個人指導請求,而新推出的 Opus 4.7 與 Mythos Preview 模型將奉承回應減半,特別是在人際關係建議方面。
xAI 自訂語音發布
xAI 推出自訂語音功能,讓使用者可從短時間錄音中克隆個人語音,並應用於 Grok 文字轉語音與語音代理 API。
OpenAI 模型行為分析:'Goblin' 詞彙抽搐
OpenAI 發現,針對「Nerdy」個性功能的獎勵訊號導致 GPT-5.1 至 GPT-5.5 的模型產生了使用 goblin 與 gremlin 隱喻的非預期習慣,且此習慣進一步在其他模型行為中泛化。
IBM Granite 4.1 LLMs 發行說明 / 技術概覽
IBM 已發布 Granite 4.1,這是一系列密集型、僅解碼器的 LLMs(3B、8B 和 30B),透過嚴謹的資料策劃和多階段強化學習管線來實現高效能。
OpenAI Stargate 計算基礎設施更新
OpenAI 已超越其在美國的 10GW AI 基礎設施初始目標,並在其位於德克薩斯州阿比林的旗艦 Stargate 站點訓練了 GPT-5.5。
OpenAI 資訊時代網路安全行動計畫
OpenAI 已推出一項五大支柱的行動計畫,以民主化 AI 驅動的網路防禦,並增強對 AI 驅動威脅的韌性。
DeepInfra 與 Hugging Face 推理提供者整合
Hugging Face 已將 DeepInfra 加入為支援的推理提供者,使開發者能直接透過 Hub 和用戶端 SDK 存取超過 100 個模型(包括 DeepSeek V4 和 Kimi-K2.6)的無伺服器推理。
使用 BioMysteryBench 評估 Claude 的生物資訊學研究能力
Anthropic 推出 BioMysteryBench,這是一個新的生物資訊學基準,最新版的 Claude 模型表現與人類專家相當,並解決了多個人類專家無法解決的問題。
NVIDIA Nemotron 3 Nano Omni 發佈說明 / 新功能介紹
NVIDIA 已發佈 Nemotron 3 Nano Omni,這是一款能夠跨文字、圖像、影片和音訊進行長上下文推理的全模態模型,在文檔智能和影片理解基準測試中提供了業界領先的準確度。
FlashQLA:適用於 CP / 反向傳播的融合線性注意力核心(針對 GDN)
Qwen 已開源 FlashQLA,這是一個基於 TileLang 的高效能線性注意力核心庫,能在 NVIDIA Hopper GPU 上為門控增量網路(GDN)層提供 2‑3 倍的前向與 2 倍的反向加速。
vLLM 中對 NVIDIA Nemotron 3 Nano Omni 的支援
vLLM 現已支援 NVIDIA Nemotron 3 Nano Omni,這是一款高效的 30 億參數 MoE 多模態模型,能在單一迴圈中統合視覺、音訊與語言推理,以驅動代理式 AI。
OpenAI 社群安全與暴力緩減框架
OpenAI 已詳細說明其多層次方法,以防止將 ChatGPT 用於規劃或執行暴力,結合模型訓練、自動偵測與人工審查。
OpenAI GPT-5.5、Codex 與 AWS 上的受管代理發布說明
2026年4月28日,OpenAI 宣佈其前沿模型(包括 GPT-5.5、Codex 程式碼代理以及由 OpenAI 提供動力的 Amazon Bedrock 受管代理)現已在 AWS 上以有限預覽方式提供,讓企業能在現有的 AWS 安全、合規與採購工作流程中使用這些功能。
OpenAI 獲得 FedRAMP Moderate 授權
OpenAI 已取得 ChatGPT Enterprise 與其 API 平台的 FedRAMP 20x Moderate 授權,使美國政府機構能在符合聯邦安全與隱私標準的前提下存取包括 GPT-5.5 在內的前沿 AI 模型。
Mistral AI Workflows 公開預覽
Mistral AI 已發布 Workflows 公開預覽版,為企業 AI 提供了一個編排層,確保生產環境 AI 流程的持久性、可觀測性與容錯能力。
TITLE: Google DeepMind 與韓國的合作
SUMMARY: Google DeepMind 已與韓國科學與資訊通訊部合作,在首爾設立 AI 校園並部署前沿 AI 模型,以加速生命科學、能源與氣候領域的科學研究。
微軟與 OpenAI 合作的下一階段
OpenAI 與微軟已修改合作協議,以提供更大的彈性,允許 OpenAI 在任何雲端服務提供商上提供產品,同時仍將微軟作為其主要雲端合作夥伴。
# Choco 使用 AI 代理自動化食品分銷
Choco 宣布使用 OpenAI API 構建的 AI 驅動的 OrderAgent 和 VoiceAgent,以自動化食品分銷訂單處理。
# OpenAI 隱私過濾器:構建可擴展的 PII 偵測網頁應用
OpenAI 已發布 Privacy Filter,一個開源的 1.5B 參數 PII 偵測器,能夠在 128k 上下文窗口內標記八種類別的敏感資料。
Symphony: Codex 編排的開源規範
OpenAI 發布了 Symphony,這是一個開源規範,將 Linear 等問題追蹤器轉化為 Codex 編碼代理的常駐編排器,使團隊能夠自動化常規實作工作並提高 PR 吞吐量。
OpenAI 通用人工智慧 (AGI) 開發的運營原則
OpenAI 已概述五項核心原則——民主化、能力賦予、韌性、普惠繁榮與適應性——以確保通用人工智慧 (AGI) 惠及全人類。
OpenAI AI 工作過渡框架
OpenAI 已推出 AI 工作過渡框架,以分析 AI 對 921 個職業的就業影響,根據自動化風險、重組、成長潛力和穩定性將工作分為四條路徑。
vLLM DeepSeek V4 支援:高效長上下文注意力
vLLM 現已支援 DeepSeek V4-Pro 與 V4-Flash,實作了一種新注意力機制,使上下文長度可達一百萬個 token,並大幅節省 KV cache 記憶體。
DeepSeek-V4 發佈說明:為 AI Agents 提供高效的 1M-Token 上下文
DeepSeek-V4 引入了由混合 CSA/HCA 注意力機制驅動的 1M-token 上下文窗口,專為長時程代理工作負載和工具使用軌跡進行了優化。
DeepSeek-V4 Preview Release
DeepSeek 已發佈開源的 DeepSeek-V4 preview,推出了兩種模型變體——Pro 與 Flash——具備 1M token 上下文窗口與尖端的 agentic coding 能力。
Anthropic 與 NEC 在日本建立 AI 原生工程夥伴關係
Anthropic 與 NEC 已建立夥伴關係,將 Claude 部署至 30,000 名 NEC 員工,並為日本金融、製造及政府部門開發安全且具備特定產業能力的 AI 產品。
Anthropic 選舉保障措施更新
Anthropic 已實施了一套全面的保障措施,包括中立性訓練與自動化分類器,以確保 Claude 在 2026 年美國中期選舉及其他全球選舉期間保持公正與安全。
OpenAI GPT-5.5 版本說明
OpenAI 已發布 GPT-5.5 與 GPT-5.5 Pro,於代理式程式編寫、電腦使用與科學研究方面帶來重大進步,同時保持 GPT-5.4 的延遲表現。
# OpenAI GPT-5.5 系統卡
OpenAI 已發布 GPT-5.5,這是一個針對複雜現實世界任務和工具使用進行優化的模型,具備增強的任務理解能力以及更穩固的安全框架。