✷ 封存 · 11 個實驗室 · 3,049 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
OpenAI 醫療保健發佈
OpenAI 已推出 OpenAI 醫療保健,這是一套符合 HIPAA 規範的工具,包括 ChatGPT for Healthcare 和 OpenAI API,旨在減輕臨床醫師的行政負擔並提升護理一致性。
Netomi 將代理系統擴展至企業規模 – 從 OpenAI 獲得的經驗教訓
Netomi 宣布推出生產級代理平台,結合了用於低延遲工具使用的 GPT-4.1 與用於深度多步驟規劃的 GPT-5.2,提供低於 3 秒的響應時間、98% 的意圖準確度,以及企業級規模的內建治理功能。
Anthropic 與 PNNL 人工智慧關鍵基礎設施防禦研究
Anthropic 與太平洋西北國家實驗室(PNNL)展示 Claude 可加速關鍵基礎設施防禦中的攻擊者模擬,將攻擊重建時間從數週縮短至三小時。
Qwen3-VL-Embedding 與 Qwen3-VL-Reranker 發布
Qwen 已發布 Qwen3-VL-Embedding 與 Qwen3-VL-Reranker,這是一系列針對文字、圖像、螢幕截圖與影片進行高精度跨模態檢索的多模態模型。
Tolan 如何使用 GPT-5.1 建構語音優先 AI
Tolan 使用 GPT-5.1 和自訂的即時情境管理系統,創建了一個低延遲、語音優先的 AI 伴侶,具備持久記憶與一致的人格。
ChatGPT Health 發行說明
OpenAI 已推出 ChatGPT Health,一個專門且安全的體驗,整合個人醫療記錄與健康應用程式資料,協助使用者在不取代臨床護理的情況下瀏覽健康資訊。
xAI 籌集 200 億美元 Series E 融資輪
xAI 宣布完成 200 億美元的 Series E 輪融資,超過了其 150 億美元的目標,以加速其龐大的 AI 運算基礎設施和產品推出。
NVIDIA Cosmos Reason 2 版本說明 / 新功能
NVIDIA 已發布 Cosmos Reason 2,一款為實體 AI 設計的開放式推理視覺語言模型,並在 Physical AI Bench 與 Physical Reasoning 排行榜上名列前茅。
Falcon-H1-Arabic 發行說明
Hugging Face 宣布了 Falcon-H1-Arabic,這是一個由三個混合 Mamba-Transformer 模型(3B、7B 和 34B)組成的系列,於阿拉伯語自然語言處理領域創下了新的最先進基準,並將上下文窗口擴展至最高 256K 令牌。
NVIDIA DGX Spark 與 Reachy Mini 整合指南
NVIDIA 已推出一個框架,透過結合 DGX Spark 硬體、Reachy Mini 機器人及 NeMo Agent Toolkit,使用開放的推理與視覺模型來打造真實世界的 AI 代理。
OpenAI Grove 第二期公告
OpenAI 已開放 OpenAI Grove 第二期的申請,該計畫旨在支援尚未有構想的技術人才打造 AI 驅動的公司。
Qwen-Image-2512 發行說明 / 新功能
Qwen-Image-2512 是 Qwen-Image 文本到圖像模型的十二月更新,顯著提升了人物寫實度、自然細節渲染以及複雜文字版面配置的準確性。
xAI 推出 Grok Business 與 Grok Enterprise
xAI 推出了 Grok Business 與 Grok Enterprise,為組織提供安全、具備權限感知能力的 AI 助手,且不會使用客戶數據進行訓練。
Google DeepMind 2025 年度回顧:Gemini 3、Gemma、AI 產品、科學與安全突破
Google DeepMind 宣布了 2025 年的突破,涵蓋 Gemini 3 模型、開源 Gemma、AI 驅動產品、生成式媒體、科學 AI、量子運算、安全框架及全球協作,標誌著 AI 從工具向公用事業的轉型。
AprielGuard:現代大型語言模型系統的安全與對抗魯棒性護欄
Hugging Face 與 ServiceNow AI 推出了 AprielGuard,一款 8 億參數的安全防護模型,旨在於單獨提示、多輪對話與代理工作流程中偵測 16 種安全風險類別以及各種對抗攻擊。
Qwen-Image-Edit-2511 發行說明
Qwen-Image-Edit-2511 是一個更新的圖像編輯模型,提升了角色一致性,整合了社群 LoRA,並增強了幾何推理與工業設計能力。
Qwen3‑TTS‑VD‑Flash 與 Qwen3‑TTS‑VC‑Flash 發布:可控語音設計與快速多語言語音克隆
Qwen 推出 Qwen3‑TTS‑VD‑Flash 用於自然語言語音設計,並推出 Qwen3‑TTS‑VC‑Flash 用於 3 秒多語言語音克隆,兩者在可控性與準確性上均超越領先的 TTS 系統。
ChatGPT Atlas: 加強瀏覽器代理防禦提示注入
OpenAI 已使用經過 RL 訓練的自動化攻擊者實施主動快速響應迴路,以在野外被利用之前發現並緩解 ChatGPT Atlas 中的提示注入漏洞。
OpenAI 客戶增長與企業採用
OpenAI 已突破一百萬家企業客戶,75% 的使用者報告能完成先前無法完成的任務。
xAI 被美國戰爭部選中,用於企業級 AI 與任務系統
xAI 已被美國戰爭部 (DOW) 選中,將其 Frontier AI 系統與 Grok 模型整合至 GenAI.Mil 套件中,為 Impact Level 5 的 300 萬名軍事與文職人員提供 AI 能力。
xAI Grok Collections API 發佈
xAI 已推出 Collections API,這是一項託管式知識庫服務,讓開發者能透過上傳資料集來進行精確的語義、關鍵字與混合搜尋,進而建構 RAG 應用程式。
Qwen-Image-Layered:層次分解以實現內在可編輯性
Qwen-Image-Layered 是一個新模型,能將圖像分解為多個 RGBA 層,允許獨立操作圖像組件而不影響其他內容。
Anthropic Bloom: 自動化行為評估開源工具
Anthropic 發布了 Bloom,這是一個開源的代理框架,能自動生成評估套件,以量化前沿 AI 模型中特定行為特徵的發生頻率與嚴重程度。
Anthropic 針對加州 SB 53 的前沿合規框架
Anthropic 已發布其前沿合規框架 (Frontier Compliance Framework, FCF) 以滿足加州《前沿 AI 透明度法案》(Transparency in Frontier AI Act, SB 53) 的透明度與安全要求。
OpenAI 評估思考鏈可監測性
OpenAI 引入了一個框架與 13 項評估,用以衡量「可監測性」——即從模型內部推理預測其行為的能力——發現監測思考鏈遠比僅監測輸出更為有效。
OpenAI Model Spec 更新: 未滿18歲(U18)原則
OpenAI 已更新其 Model Spec,加入未滿18歲(U18)原則,為 ChatGPT 建立適合年齡的行為指引,以優先考慮13至17歲使用者的青少年安全與現實世界支援。
OpenAI 青少年與家長的 AI 素養資源
OpenAI 發布了一套 AI 素養資源,包括面向家庭的指南與針對家長的建議,協助家庭安全且負責任地使用 ChatGPT。
OpenAI 與美國能源部擴展 AI 合作
OpenAI 與美國能源部已簽署備忘錄,將前沿 AI 模型整合到科學研究中,特別是支持 Genesis Mission 和國家實驗室計畫。
Transformers v5 斷詞更新
Hugging Face 重新設計了 Transformers v5 的斷詞系統,將斷詞器架構與已訓練的詞彙表分離,使得檢視、客製化以及從頭訓練更加容易。
GPT-5.2-Codex 發佈說明
OpenAI 已發布 GPT-5.2-Codex,一款針對複雜軟體工程、長期任務與先進資安研究進行優化的代理式編程模型。
OpenAI GPT-5.2-Codex 系統卡補遺
OpenAI 已發布 GPT-5.2-Codex,一款針對複雜軟體工程、專案規模重構與網路安全任務進行優化的代理式編碼模型。
Anthropic Project Vend 第二階段:AI店員獲利,但仍需人類監控
Anthropic 的 Project Vend 第二階段將店員 AI Claude(更名為 Claudius)升級至 Claude Sonnet 4.x,新增工具、執行長代理與商品設計夥伴,提升三地營運獲利,但突顯出持續存在的穩健性缺口。
Anthropic 宣布為 Claude 提供新的安全防護措施以保護使用者福祉
Anthropic 詳細說明了 Claude 的新模型與產品安全防護措施,包括自殺/自殘處理、減少諂媚行為,以及 18 歲以上的年齡限制,其在內部評估中顯示出極高的適當性比率。
Anthropic 與美國能源部合作開展 Genesis Mission
Anthropic 已加入美國能源部 (DOE) 的 Genesis Mission,成為多年期合作夥伴,旨在將前沿 AI 整合到美國的能源主導地位、生物科學及科學生產力中。
Mistral OCR 3 發佈說明
Mistral AI 已發佈 Mistral OCR 3,這是一款高保真度文件解析模型,在處理複雜文件和手寫內容方面比其前身具有 74% 的勝率,定價為每 1,000 頁 $2。
NVIDIA Nemotron 3 Nano 開放評估配方與 NeMo Evaluator
NVIDIA 發布了 30 億參數的 Nemotron 3 Nano 模型,並提供了基於 NeMo Evaluator 的完整開放評估配方,使任何人都能重現其基準分數並審核整個評估流程。
Gemini 3 Flash 版本說明 / 新功能
Google DeepMind 已發布 Gemini 3 Flash,這是一種結合前沿級推理與多模態智能、具備低延遲並降低開發者與消費者成本的模型。
OpenAI 新聞機構學院啟動
OpenAI 已推出 OpenAI 新聞機構學院,為記者提供培訓、手冊以及負責任採用 AI 的指導,以提升報導和業務運營。
OpenAI 推出 ChatGPT 的應用程式提交與目錄
OpenAI 已推出應用程式目錄和 beta Apps SDK,讓開發者能夠直接在 ChatGPT 中建構、提交並變現聊天原生體驗。
企業 AI 2025 年狀態報告
OpenAI 的 2025 年報告顯示,企業 AI 採用正在快速擴展,ChatGPT 訊息量年增 8 倍,API 推理 token 消耗年增 320 倍。
xAI Grok Voice Agent API 發佈
xAI 已推出 Grok Voice Agent API,這是一個高速、多語言的語音代理系統,在 Big Bench Audio 中排名第一,且費用為每分鐘 0.05 美元。
Gemma Scope 2 發佈 – 用於解讀 Gemma 3 語言模型的開源工具
Gemma Scope 2 是一套針對 Gemma 3 模型(270M‑27B 參數)的開源可解釋性工具,讓研究人員能追蹤內部計算並除錯安全關鍵行為。
OpenAI 已推出 FrontierScience,這是一個新的專家級基準測試,旨在衡量 AI 進行複雜科學推理和真實世界研究任務的能力,涵蓋物理、化學和生物學。
OpenAI 已推出 FrontierScience,這是一個新的專家級基準測試,旨在衡量 AI 進行複雜科學推理和真實世界研究任務的能力,涵能、化學和生物學。
OpenAI GPT-5 生物研究能力
OpenAI 展示了 GPT-5 能夠自主優化分子克隆協議,透過發現新穎的酶促機制,實現效率提升 79 倍。
OpenAI 指南:在 AI 時代保持領先
OpenAI 提出了一個五步驟的遊戲書——對齊、啟用、放大、加速和治理——以幫助組織過渡為 AI 優先的公司並保持競爭優勢。
ChatGPT Images 和 GPT Image 1.5 發布
OpenAI 已發布新旗艦圖像生成模型 GPT Image 1.5,提供最高 4 倍更快的生成速度以及顯著提升的精準編輯和文字渲染能力。
Anthropic 為 Claude 推出的 "think" 工具
Anthropic 推出了 "think" 工具,這是一個專用的推理空間,可提升 Claude 在複雜任務中的代理工具使用、政策遵循以及序列化決策能力。
CUGA 在 Hugging Face:讓可設定的 AI 代理普及化
IBM Research 已發布 CUGA(可設定通用代理),這是一個開源代理框架,在 AppWorld 和 WebArena 基準測試中對複雜的 API 和網頁任務達到最先進的性能。
Gemini 2.5 Flash Native Audio 發布:增強即時語音代理與即時語音翻譯
Google DeepMind 宣布推出 Gemini 2.5 Flash Native Audio,這是一個即時語音模型,提升了函式呼叫、指令遵循以及多輪對話能力,並新增支援超過 70 種語言的即時語音對語音翻譯。
BBVA 與 OpenAI 戰略性 AI 轉型合作
BBVA 與 OpenAI 已擴大他們的合作夥伴關係,將 ChatGPT Enterprise 部署給全球 120,000 名員工,以轉變客戶體驗和內部運營。