✷ 封存 · 11 個實驗室 · 3,053 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
偵測與減少 AI 模型的策劃行為
OpenAI 與 Apollo Research 開發了審議式對齊方法,將前沿模型的隱蔽行動降低約 30 倍,從而應對模型偽裝對齊卻暗中追求隱蔽議程的 AI 策劃風險。
Anthropic 事後檢討:影響 Claude 回應品質的基礎設施錯誤
Anthropic 已解決了在 2025 年 8 月至 9 月期間間歇性降低 Claude 回應品質的三個獨立基礎設施錯誤,並澄清,模型品質絕不會因伺服器負載而刻意降低。
OpenAI 推出 Stargate UK 以支援主權 AI 基礎設施
OpenAI、NVIDIA 與 Nscale 合作推出 Stargate UK,這是一項 AI 基礎設施計畫,提供本地運算能力給 OpenAI 模型,以支援英國的主權 AI 能力。
OpenAI 年齡預測與青少年安全保護
OpenAI 正在開發一套年齡預測系統,以自動對未滿 18 歲的使用者套用適齡政策,並將於 2025 年 9 月底推出家長控制功能。
OpenAI 青少年安全、自由與隱私框架
OpenAI 正在實施分層安全框架,將青少年保護置於隱私與自由之上,並包括年齡預測系統,以對未滿 18 歲的使用者施加更嚴格的內容限制。
LeRobotDataset v3.0 版本說明 / 新功能
Hugging Face 已發布 LeRobotDataset v3.0,一種標準化的機器人學習資料集格式,能夠支援大規模資料儲存與串流,以容納數百萬個情節。
OpenAI GPT-5-Codex 發布與 Codex 平台更新
OpenAI 已發布針對代理式軟體工程優化的 GPT-5-Codex,並同步推出 Codex CLI、IDE 擴充套件與雲端環境的重大更新。
人們如何使用 ChatGPT:1.5 百萬對話的分析
OpenAI 與哈佛經濟學者 David Deming 發布了一項針對 150 萬次 ChatGPT 對話的研究,顯示 AI 的採用正跨越性別與收入層面實現民主化,且主要作為日常實用指導與決策支援的工具。
使用 Gradio 的可見水印
Hugging Face 已推出簡易方式,透過 Gradio 函式庫為 AI 生成的圖像、影片與文字加入可見水印,以提升合成內容的透明度。
GPT-5-Codex 發布與安全附錄
OpenAI 已發布 GPT-5-Codex,這是針對代理式編程進行強化學習訓練、在真實任務上優化的 GPT-5 版本。
Anthropic 2025 年 9 月經濟指數報告
Anthropic 發布了 2025 年 9 月經濟指數,顯示透過 Claude 進行的 AI 採用率因國家收入、美國州份產業組合以及企業與消費者使用方式而有顯著差異,其中指令式自動化在互動中的比例從 27% 上升至 39%。
Anthropic 經濟指數 2025 年 9 月報告
Anthropic 2025 年 9 月的經濟指數報告顯示,AI 採用在地理與企業層面極度不均,使用集中於高收入地區,且主要由程式設計與自動化任務主導。
Claude Sonnet 4 集成於 Xcode 26
Anthropic 已在 Xcode 26 中正式提供 Claude Sonnet 4,讓 Apple 平台開發者能夠直接在其 IDE 中訪問 AI 驅動的編碼智能功能。
OpenAI 與美國 CAISI 及英國 AISI 的安全合作
OpenAI 已與美國人工智慧標準與創新中心(CAISI)以及英國人工智慧安全研究所(UK AISI)合作,進行針對代理式 AI 與生物安全防護措施的深入紅隊測試與漏洞測試。
Claude Desktop Extensions 發佈說明 / 有什麼新功能
Anthropic 推出了 Desktop Extensions (.mcpb 檔案),這是一種全新的封裝格式,讓 Claude Desktop 可以一鍵安裝 Model Context Protocol (MCP) 伺服器,消除了手動設定與開發者工具的需求。
Anthropic 與美國 CAISI 及英國 AISI 合作強化 AI 安全防護
Anthropic 與美國 CAISI 及英國 AISI 合作進行壓力測試,以強化其 AI 系統的安全性,特別針對其「憲法分類器」中的漏洞進行強化。
Writer Palmyra-mini 系列發布
Writer 已發布 Palmyra-mini 系列,這是一組輕量級開源模型(參數量介於 1.5B 至 1.7B),包括一個基礎模型以及兩個針對邏輯與數學優化的專門推理變體。
OpenAI 與微軟合作夥伴關係更新
OpenAI 與微軟已簽署一份非約束性諒解備忘錄,進入合作的下一階段,重點在於 AI 工具的交付與安全。
OpenAI 非營利組織與公共利益公司(PBC)結構演變
OpenAI 正在演變其結構,使其非營利實體控制公共利益公司(PBC),並持有超過 1,000 億美元的股權,以資助其確保 AGI 造福全人類的使命。
Transformers 4.40 性能升級:OpenAI GPT‑OSS 零建構核心、MXFP4 量化、平行化與更快載入
Hugging Face 為 OpenAI 的 GPT‑OSS 模型在 transformers 套件中加入了零建構核心、MXFP4 4 位元量化、張量與專家平行化、動態滑動視窗快取、持續批次處理以及更快的模型載入,顯著提升了效率與可擴展性。
為 AI Agent 編寫高效工具:Anthropic 工程指南
Anthropic 概述了一套系統化、由評估驅動的框架,用於為非確定性的 AI Agent 設計工具,強調以 Agent 為中心的設計,而非傳統的確定性 API 模式。
使用 Together AI 微調 Hugging Face Hub 的大型語言模型
Together AI 與 Hugging Face 已整合平台,讓開發者能使用 Together AI 的基礎設施微調 Hugging Face Hub 上任何相容的 LLM。
Jupyter Agents:訓練 LLM 以筆記本推理
Hugging Face 推出了一條用於產生高品質合成資料與最佳化腳手架的流水線,將像 Qwen3-4B 這樣的小型 LLM 轉變為最先進的資料科學代理。
SafetyKit Risk Agents powered by OpenAI Models
SafetyKit 利用 GPT-5、GPT-4.1 和其他 OpenAI 模型,以超過 95% 的準確度對 100% 的客戶內容進行欺詐和違規活動的自動化檢測。
Mistral AI 系列 C 輪融資公告
Mistral AI 在 ASML 領投下完成 17 億歐元系列 C 輪融資,融資後估值達 117 億歐元,以加速戰略產業的前沿 AI 研究。
mmBERT:ModernBERT 走向多語言化
Hugging Face 推出 mmBERT,一個在 3 兆以上 token、涵蓋 1,800 多種語言的超大規模多語言編碼模型,於效能與推論速度上均優於 XLM-R。
OpenAI 以人為本 AI 基金
OpenAI 已開放申請 5,000 萬美元基金,提供無限制補助金給美國非營利組織,以推動 AI 素養、社區創新與經濟機會。
Anthropic 支持加州 SB 53
Anthropic 已支持加州參議院第 53 號法案 (SB 53),這是一個針對強大 AI 系統的監管框架,優先考慮透明度與披露,而非指令式的技術指令。
OpenAI 研究:為何語言模型會產生幻覺
OpenAI 主張,語言模型產生幻覺是因為標準的訓練與評估程序傾向獎勵猜測而非承認不確定性,而非源於神祕的錯誤。
OpenAI for Greece 合作夥伴關係啟動教育試點與 AI 加速器
OpenAI 宣佈了 ‘OpenAI for Greece’ 合作夥伴關係,於中學啟動 ChatGPT Edu 試點並設立希臘 AI 加速器以促進本地 AI 初創企業,標誌著在希臘教育與創新領域嵌入先進 AI 的重要一步。
Anthropic 的 LLM 與生化風險:評估人工智慧驅動的生物威脅
Anthropic 宣布其 Claude Opus 4 模型現已啟用人工智慧安全等級 3 防護機制,以阻止協助生物武器開發,並詳細說明其關於人工智慧驅動生物風險與緩解策略的研究。
OpenAI 透過 AI 計畫擴大經濟機會
OpenAI 宣布了 OpenAI Jobs Platform 與 OpenAI Certifications,協助員工提升 AI 流利度並與雇主接軌,目標在 2030 年前認證 1,000 萬名美國人。
EmbeddingGemma 300M 版本說明
Google 發布了 EmbeddingGemma,一款 308M 參數的多語言嵌入模型,在 500M 以下模型的 MTEB 基準測試中名列前茅,且針對裝置端使用進行了優化。
Anthropic 更新區域銷售限制以防止對手存取
Anthropic 正在加強其服務條款,以禁止受不支持區域(例如中國)控制的公司存取其服務,無論其子公司在何處註冊成立。
Anthropic 加入白宮 AI 教育承諾
Anthropic 已承諾透過在 K-12 網路安全領域投資 100 萬美元、支持總統 AI 挑戰賽,以及為教育工作者推出 Creative Commons AI Fluency 教學課程,來擴大 AI 教育的普及機會。
SandboxAQ SAIR 資料集發布
SandboxAQ 已發布 SAIR,這是目前最大規模的共摺疊 3D 蛋白質‑配體結構資料集,配有實驗測得的 IC50 標籤,提供超過 500 萬個 AI 生成的結構,以加速 AI 驅動的藥物發現。
Mistral AI Le Chat Memories Beta Release
Mistral AI 為 Le Chat 推出了 Memories (beta),這是一個旨在強調透明度與使用者控制權的混合記憶系統,讓 AI 能夠在無需重新訓練的情況下,召回過去的對話與上傳的檔案。
OpenAI 收購 Statsig 並任命 Vijaye Raji 為應用程式部門的首席技術官
OpenAI 收購了實驗平台 Statsig,並任命其創辦人兼執行長 Vijaye Raji 為應用程式部門的首席技術官,負責領導 ChatGPT 與 Codex 的產品工程。
OpenAI 更新 ChatGPT 安全與福祉倡議
OpenAI 正在推行為期 120 天的計畫,以提升 ChatGPT 在精神健康危機中的回應,並在醫療專家網路的指導下為青少年推出家長控制功能。
Mistral AI Le Chat 更新:MCP 連接器與記憶功能
Mistral AI 為 Le Chat 引入了由 MCP 驅動的連接器與「記憶 (Memories)」功能,實現了與 20 多種企業工具的無縫整合,並能在對話間維持個人化的上下文。
Hugging Face ZeroGPU 前置編譯指南
Hugging Face 為 ZeroGPU Spaces 引入前置編譯(AoT),透過消除即時編譯開銷,使 Flux、Wan、LTX 等生成模型的速度提升 1.3 倍至 1.8 倍。
Anthropic 系列 F 輪融資與估值更新
Anthropic 已由 ICONIQ 領投完成一輪 130 億美元的系列 F 融資,融資後估值達 1830 億美元,用以支持企業成長與安全研究。
word2vec學習了什麼:特徵學習的閉式理論
BAIR研究人員提出了一個可預測的理論,證明word2vec的學習可簡化為無權重最小二乘矩陣分解,學得的表示實質上是對特定目標矩陣進行主成分分析(PCA)的結果。
Anthropic Claude 3.5 Sonnet 電腦使用能力
Anthropic 已為 Claude 3.5 Sonnet 推出了公開測試版,讓該模型能透過移動游標、點擊與打字來直接與電腦螢幕互動,模擬人類的電腦互動方式。
Claude 3.5 Sonnet 發佈說明 / 有什麼新功能
Anthropic 已發佈 Claude 3.5 Sonnet,該模型在推理與程式碼編寫基準測試中表現優於 Claude 3 Opus 與競爭對手,且運行速度是 Opus 的兩倍。
Anthropic Clio 隱私保護分析工具
Anthropic 宣布推出 Clio,一個自動化且保護隱私的系統,能將真實世界中 Claude 的使用情況聚合為抽象主題聚類,以提升安全監控,同時不暴露使用者資料。
OpenAI gpt-realtime 與 Realtime API 正式上線
OpenAI 已發布 gpt-realtime,一款高效能語音對語音模型,並正式開放 Realtime API,支援圖像輸入、遠端 MCP 伺服器與 SIP 電話呼叫。
OpenAI 支持非營利組織與社區創新基金
OpenAI 正在開放申請一項 5,000 萬美元的基金,向美國境內的 501(c)(3) 非營利組織與社區組織提供無限制的補助金,以促進以 AI 為驅動的公共利益創新。
Grok Code Fast 1 發佈說明 / 有什麼新功能
xAI 已發佈 grok-code-fast-1,這是一款針對速度、成本效益以及跨多種程式語言的代理式編碼工作流優化的全新模型架構。
OpenAI 集體對齊與模型規範更新
OpenAI 推出了一項集體對齊研究計畫,將超過 1,000 名全球參與者的公共偏好納入其模型規範,以確保 AI 的預設行為能反映多元的人類價值觀。