封存 · 11 個實驗室 · 3,049 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

1101

BNY 與 OpenAI 合作:透過 Eliza 平台擴展企業級 AI

BNY 已部署一個名為 Eliza 的集中式 AI 平台,使 20,000 名員工能夠在嚴格的治理框架內使用 OpenAI 前沿模型構建超過 125 個即時 AI 代理。

1102

OpenAI Sora for Android: 使用 Codex 在 28 天內構建

OpenAI 使用四名工程師的精簡團隊和 GPT-5.1-Codex 模型,在 28 天內開發並發布了 Sora Android 應用程式,實現了 99.9% 無崩潰率。

1103

llama.cpp 模型管理與路由模式

llama.cpp 伺服器引入路由模式,使得無需重新啟動伺服器即可動態載入、卸載及在多個 GGUF 模型之間切換。

1104

OpenAI GPT-5.2 發布:推進科學與數學

OpenAI 已發布 GPT-5.2 Pro 與 GPT-5.2 Thinking,這些模型旨在提升科學與數學推理能力,並在 GPQA Diamond 與 FrontierMath 基準測試上達到最先進的表現。

1105

Google DeepMind 與英國 AI 安全研究所擴展合作伙伴關係

Google DeepMind 透過一份新的諒解備忘錄,將其與英國 AI 安全研究所 (AISI) 的合作擴展至專注於基礎安全與安全研究。

1106

華特迪士尼公司與 OpenAI 合作協議

華特迪士尼公司與 OpenAI 已簽訂為期三年的授權協議及 10億美元的股權投資,以將迪士尼角色整合至 Sora 與 ChatGPT Images,預計於 2026 年初推出。

1107

Podium AI 代理與 GPT-5.1 整合

Podium 已將由 GPT-5.1 驅動的 AI 代理部署到超過 10,000 家小型企業,透過自動化潛在客戶捕獲與排程,實現 24/7 可用性,從而帶來顯著的收入增長。

1108

Hugging Face 整合 Codex 以進行端到端機器學習實驗

Hugging Face 透過提供 OpenAI Codex 存取 HF-skills 倉庫的權限,使其能夠執行端到端機器學習實驗,從而讓代理能夠自動化微調、評估和部署。

1109

OpenAI 十週年反思

OpenAI 回顧其從小型研究團隊發展為 AGI 領導者的十年旅程,強調關鍵技術里程碑與迭代部署策略。

1110

GPT-5.2 系統卡更新

OpenAI 已發布 GPT-5.2 模型系列的系統卡更新,該更新保持與先前 GPT-5 和 GPT-5.1 版本相同的安全緩解方法。

1111

OpenAI GPT-5.2 版本說明

OpenAI 已發布 GPT-5.2,一個包含 Instant、Thinking 和 Pro 版本的模型系列,在專業知識工作、軟體工程和抽象推理方面設定了新的最先進基準。

1112

xAI 與薩爾瓦多全國 AI 教育計畫

xAI 與薩爾瓦多政府合作,在 5,000 所公立學校部署 Grok,旨在未來兩年內為超過一百萬名學生提供個人化的 AI 輔導。

1113

Google DeepMind 與英國政府合作夥伴關係公告

Google DeepMind 正深化與英國政府的合作,以加速 AI 在科學、教育、公共服務及國家安全領域的整合。

1114

OpenAI 網路韌性策略

OpenAI 正在實施深度防禦安全堆疊和新的生態系統計畫,包括 Aardvark 代理安全研究員,以確保不斷進步的 AI 網路能力主要惠於防禦者。

1115

Anthropic 衡量 Claude 中的政治偏見

Anthropic 推出了新的開源自動化評估方法,用以衡量 AI 模型中的政治公正性,並報告 Claude Sonnet 4.5 在與其他領先模型競爭時表現相當。

1116

Scout24 整合 GPT-5 以實現對話式房地產搜尋

Scout24 已推出 HeyImmo,這是一個由 GPT-5 驅動的對話式助理,將房地產搜尋從結果導向的過程轉變為引導式、專家領導的體驗。

1117

Mistral AI Devstral 2 與 Mistral Vibe CLI 發佈

Mistral AI 已發佈 Devstral 2 (123B) 與 Devstral Small 2 (24B),這兩款開源權重編碼模型在 SWE-bench Verified 上取得了頂尖水準的效能,並具備高成本效益,同時搭配開源的 Mistral Vibe CLI 以實現自主程式碼自動化。

1118

Google DeepMind FACTS 基準套件發布

Google DeepMind 已推出 FACTS 基準套件,一套旨在系統性評估並提升大型語言模型在參數知識、搜尋工具使用、多模態輸入和基礎情境方面事實性的四個基準的綜合集合。

1119

OpenAI 共同創立 Agentic AI 基金會並捐贈 AGENTS.md

OpenAI、Anthropic 和 Block 在 Linux Foundation 下共同創立了 Agentic AI 基金會(AAIF),以建立開放且互操作的 agentic AI 系統標準。

1120

OpenAI 認證: AI 基礎與 ChatGPT 基礎課程(教師版)

OpenAI 已推出兩項新認證課程——AI 基礎與 ChatGPT 基礎課程(教師版)——以提供實用的 AI 技能,並朝著到 2030 年認證 1,000 萬美國人的目標努力。

1121

OpenAI 與 Deutsche Telekom 合作

OpenAI 與 Deutsche Telekom 已合作,為數百萬歐洲客戶整合先進的 AI 能力,並部署 ChatGPT Enterprise 以供內部運營使用。

1122

澳洲聯邦銀行 AI 流暢度計畫

澳洲聯邦銀行正在向近 50,000 名員工部署 ChatGPT Enterprise,以在整個組織中嵌入 AI 流暢度並改善客戶成果。

1123

OpenAI 任命 Denise Dresser 為首席收入官

OpenAI 已任命前 Slack 首席執行官 Denise Dresser 為首席收入官,以領導全球收入策略並擴大 AI 在企業運營中的採用。

1124

Anthropic 將模型上下文協定捐贈給代理 AI 基金會

Anthropic 已將模型上下文協定(MCP)捐贈給 Linux 基金會下的代理 AI 基金會,以確保該標準保持開放、供應商中立且由社群驅動。

1125

Anthropic 與 Accenture 合作推動企業級 AI 部署

Anthropic 與 Accenture 已啟動多年期合作夥伴關係及 Accenture Anthropic Business Group,旨在利用 Claude 模型與 Claude Code 將企業從 AI 試點轉向全面規模化生產。

1126

Qwen3-Omni-Flash-2025-12-01 發行說明

Qwen3-Omni-Flash-2025-12-01 是一個升級的原生多模態模型,提升了即時音視互動、系統提示控制,以及跨文字、圖像、音訊與影片等多種模態的多語言支援。

1127

Instacart 與 OpenAI 合作夥伴:ChatGPT 中的 AI 驅動雜貨購物

OpenAI 與 Instacart 已合作,將一個功能完整的雜貨購物和 Instant Checkout 體驗直接整合到 ChatGPT 中,由 Agentic Commerce Protocol 提供動力。

1128

企業 AI 2025 現況報告

OpenAI 的 2025 年報告顯示,企業 AI 的採用正在廣度和深度兩方面加速,員工每日節省 40-60 分鐘,推理 token 消耗增加了 320 倍。

1129

維珍航空 AI 實施與策略

維珍航空利用 OpenAI 的 ChatGPT Enterprise、Codex 和 Realtime Voice API 推動運營生產力,並打造符合品牌調性的數字旅遊禮賓服務。

1130

Anthropic 經濟研究團隊概覽

Anthropic 的經濟研究團隊開發實證數據和指數,以衡量 AI 對工作、生產力和全球經濟的真實世界影響。

1131

swift-huggingface 發行說明 / 新功能

Hugging Face 已發布 swift-huggingface,這是一個完整的 Swift 客戶端,用於 Hugging Face Hub,提供可靠的模型下載、與 Python 相容的快取以及 OAuth 2.0 支援。

1132

SAPO:一種穩定且高效能的強化學習方法,用於訓練大型語言模型

Qwen 推出 Soft Adaptive Policy Optimization(SAPO),這是一種以平滑、受溫度控制的 gating 函數取代硬裁剪的 RL 方法,旨在提升 LLM 訓練的穩定性與樣本效率。

1133

OpenAI 澳大利亞倡議

OpenAI 已推出「OpenAI for Australia」全國性計畫,旨在建置主權 AI 基礎設施、為 120 萬名員工提供 AI 素養培訓,並透過 API 點數與導師指導支援本地新創企業。

1134

使用 AlphaFold 工程耐熱作物

密西根州立大學的研究人員使用 AlphaFold 工程了一種混合甘油酸激酶酶,該酶在高達 65°C 的溫度下仍保持穩定,為創造更具韌性的糧食作物提供了藍圖。

1135

Qwen3-TTS-Flash 更新:49 種音色、10 種語言與 9 種方言

Qwen3-TTS-Flash 是一款旗艦級文字轉語音模型,支援 49 種高品質音色、10 種語言以及 9 種中文方言,具備改進的韻律與自然的語速。

1136

Hugging Face Skills: 讓 AI 代理能夠微調 LLMs

Hugging Face 已推出 Hugging Face Skills,一種工具,允許像 Claude Code 這樣的編碼代理管理整個 LLM 微調生命週期,從硬體選擇到模型部署。

1137

DeepMath: 輕量級數學推理 Agent,搭配 smolagents

DeepMath 是一個基於 Qwen3-4B Thinking 的數學推理 Agent,透過 GRPO 微調,用簡潔的 Python 程式碼片段取代冗長文字以進行確定性計算,使輸出長度減少多達 66% 同時提升準確度。

1138

Anthropic Interviewer:擴展AI整合的質性研究規模

Anthropic 推出 Anthropic Interviewer,一款能進行大規模、適應性質性訪談的AI工具,以理解專業人士如何將AI整合至其工作流程中。

1139

OpenAI 將收購 Neptune

OpenAI 已經訂立最終協議收購 neptune.ai,將先進的實驗追蹤與訓練監控工具整合到其前沿研究基礎設施中。

1140

OpenAI 認罪:提升模型誠實與透明度

OpenAI 已引入認罪,這是一種訓練技巧,鼓勵 AI 模型在單獨的輸出通道中明確承認如獎勵駭客或幻覺等不當行為,顯著提升了模型錯位的可見性。

1141

OpenAI 以人為本的人工智慧基金 初始受助者

OpenAI 已宣布其 People-First AI 基金的第一批受助者,支持全美各地廣泛的社區組織。

1142

Snowflake 與 Anthropic 合作推動企業級自主型 AI

Anthropic 與 Snowflake 宣布一項價值 2 億美元、多年期的合作,將 Claude 模型整合至 Snowflake 平台,讓全球企業能於結構化與非結構化資料上部署安全、自主型 AI 代理。

1143

Anthropic 收購 Bun 以加速 Claude Code 的開發

Anthropic 已收購 JavaScript runtime Bun,以增強 Claude Code 的效能與基礎設施,Claude Code 在公開發布後的六個月內便達到了 10 億美元的年化營收里程碑。

1144

Mistral 3 發佈說明:Mistral Large 3 與 Ministral 3 系列

Mistral AI 已發佈 Mistral 3,其特色包含尖端規模的 Mistral Large 3 MoE 模型與邊緣優化的 Ministral 3 系列(3B、8B、14B),所有模型均採用 Apache 2.0 授權。

1145

AI 如何改變 Anthropic 的工作模式

Anthropic 的內部研究顯示,AI 整合帶來了 50% 的自我報告生產力提升,並促使工程師向「全端」能力轉變,同時也引發了技能退化與工作場所社交動態變化的擔憂。

1146

Mirakl 代理商務願景與 AI 實施

Mirakl 正從 AI 消費過渡到代理建構者文化,透過代理工作流程在目錄上架和客戶支援方面實現顯著的效率提升。

1147

OpenAI AI 與心理健康研究補助金

OpenAI 已啟動一項資助計畫,以支援獨立、跨學科的研究,探討 AI 在心理健康交叉點上的風險與收益。

1148

OpenAI 與 NORAD 節日合作

OpenAI 與 NORAD 合作,在 ChatGPT 內推出三款由 AI 驅動的節日工具——精靈註冊、聖誕玩具實驗室、聖誕故事創造器——以增強 NORAD Tracks Santa 計畫。

1149

OpenAI 取得 Thrive Holdings 的所有權股權,以推動企業 AI 採用

OpenAI 已取得 Thrive Holdings 的所有權股權,以將前沿 AI 研究與工程團隊直接嵌入企業運營,最初專注於會計與 IT 服務。

1150

Accenture 與 OpenAI 企業級 AI 合作

Accenture 與 OpenAI 已結為合作夥伴,透過旗艦 AI 客戶計畫以及大規模提升 Accenture 專業人員的技能,加速大型企業採用具代理能力的 AI 能力。