封存 · 11 個實驗室 · 3,053 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

1401

偵測與減少 AI 模型的策劃行為

OpenAI 與 Apollo Research 開發了審議式對齊方法,將前沿模型的隱蔽行動降低約 30 倍,從而應對模型偽裝對齊卻暗中追求隱蔽議程的 AI 策劃風險。

1402

Anthropic 事後檢討:影響 Claude 回應品質的基礎設施錯誤

Anthropic 已解決了在 2025 年 8 月至 9 月期間間歇性降低 Claude 回應品質的三個獨立基礎設施錯誤,並澄清,模型品質絕不會因伺服器負載而刻意降低。

1403

OpenAI 推出 Stargate UK 以支援主權 AI 基礎設施

OpenAI、NVIDIA 與 Nscale 合作推出 Stargate UK,這是一項 AI 基礎設施計畫,提供本地運算能力給 OpenAI 模型,以支援英國的主權 AI 能力。

1404

OpenAI 年齡預測與青少年安全保護

OpenAI 正在開發一套年齡預測系統,以自動對未滿 18 歲的使用者套用適齡政策,並將於 2025 年 9 月底推出家長控制功能。

1405

OpenAI 青少年安全、自由與隱私框架

OpenAI 正在實施分層安全框架,將青少年保護置於隱私與自由之上,並包括年齡預測系統,以對未滿 18 歲的使用者施加更嚴格的內容限制。

1406

LeRobotDataset v3.0 版本說明 / 新功能

Hugging Face 已發布 LeRobotDataset v3.0,一種標準化的機器人學習資料集格式,能夠支援大規模資料儲存與串流,以容納數百萬個情節。

1407

OpenAI GPT-5-Codex 發布與 Codex 平台更新

OpenAI 已發布針對代理式軟體工程優化的 GPT-5-Codex,並同步推出 Codex CLI、IDE 擴充套件與雲端環境的重大更新。

1408

人們如何使用 ChatGPT:1.5 百萬對話的分析

OpenAI 與哈佛經濟學者 David Deming 發布了一項針對 150 萬次 ChatGPT 對話的研究,顯示 AI 的採用正跨越性別與收入層面實現民主化,且主要作為日常實用指導與決策支援的工具。

1409

使用 Gradio 的可見水印

Hugging Face 已推出簡易方式,透過 Gradio 函式庫為 AI 生成的圖像、影片與文字加入可見水印,以提升合成內容的透明度。

1410

GPT-5-Codex 發布與安全附錄

OpenAI 已發布 GPT-5-Codex,這是針對代理式編程進行強化學習訓練、在真實任務上優化的 GPT-5 版本。

1411

Anthropic 2025 年 9 月經濟指數報告

Anthropic 發布了 2025 年 9 月經濟指數,顯示透過 Claude 進行的 AI 採用率因國家收入、美國州份產業組合以及企業與消費者使用方式而有顯著差異,其中指令式自動化在互動中的比例從 27% 上升至 39%。

1412

Anthropic 經濟指數 2025 年 9 月報告

Anthropic 2025 年 9 月的經濟指數報告顯示,AI 採用在地理與企業層面極度不均,使用集中於高收入地區,且主要由程式設計與自動化任務主導。

1413

Claude Sonnet 4 集成於 Xcode 26

Anthropic 已在 Xcode 26 中正式提供 Claude Sonnet 4,讓 Apple 平台開發者能夠直接在其 IDE 中訪問 AI 驅動的編碼智能功能。

1414

OpenAI 與美國 CAISI 及英國 AISI 的安全合作

OpenAI 已與美國人工智慧標準與創新中心(CAISI)以及英國人工智慧安全研究所(UK AISI)合作,進行針對代理式 AI 與生物安全防護措施的深入紅隊測試與漏洞測試。

1415

Claude Desktop Extensions 發佈說明 / 有什麼新功能

Anthropic 推出了 Desktop Extensions (.mcpb 檔案),這是一種全新的封裝格式,讓 Claude Desktop 可以一鍵安裝 Model Context Protocol (MCP) 伺服器,消除了手動設定與開發者工具的需求。

1416

Anthropic 與美國 CAISI 及英國 AISI 合作強化 AI 安全防護

Anthropic 與美國 CAISI 及英國 AISI 合作進行壓力測試,以強化其 AI 系統的安全性,特別針對其「憲法分類器」中的漏洞進行強化。

1417

Writer Palmyra-mini 系列發布

Writer 已發布 Palmyra-mini 系列,這是一組輕量級開源模型(參數量介於 1.5B 至 1.7B),包括一個基礎模型以及兩個針對邏輯與數學優化的專門推理變體。

1418

OpenAI 與微軟合作夥伴關係更新

OpenAI 與微軟已簽署一份非約束性諒解備忘錄,進入合作的下一階段,重點在於 AI 工具的交付與安全。

1419

OpenAI 非營利組織與公共利益公司(PBC)結構演變

OpenAI 正在演變其結構,使其非營利實體控制公共利益公司(PBC),並持有超過 1,000 億美元的股權,以資助其確保 AGI 造福全人類的使命。

1420

Transformers 4.40 性能升級:OpenAI GPT‑OSS 零建構核心、MXFP4 量化、平行化與更快載入

Hugging Face 為 OpenAI 的 GPT‑OSS 模型在 transformers 套件中加入了零建構核心、MXFP4 4 位元量化、張量與專家平行化、動態滑動視窗快取、持續批次處理以及更快的模型載入,顯著提升了效率與可擴展性。

1421

為 AI Agent 編寫高效工具:Anthropic 工程指南

Anthropic 概述了一套系統化、由評估驅動的框架,用於為非確定性的 AI Agent 設計工具,強調以 Agent 為中心的設計,而非傳統的確定性 API 模式。

1422

使用 Together AI 微調 Hugging Face Hub 的大型語言模型

Together AI 與 Hugging Face 已整合平台,讓開發者能使用 Together AI 的基礎設施微調 Hugging Face Hub 上任何相容的 LLM。

1423

Jupyter Agents:訓練 LLM 以筆記本推理

Hugging Face 推出了一條用於產生高品質合成資料與最佳化腳手架的流水線,將像 Qwen3-4B 這樣的小型 LLM 轉變為最先進的資料科學代理。

1424

SafetyKit Risk Agents powered by OpenAI Models

SafetyKit 利用 GPT-5、GPT-4.1 和其他 OpenAI 模型,以超過 95% 的準確度對 100% 的客戶內容進行欺詐和違規活動的自動化檢測。

1425

Mistral AI 系列 C 輪融資公告

Mistral AI 在 ASML 領投下完成 17 億歐元系列 C 輪融資,融資後估值達 117 億歐元,以加速戰略產業的前沿 AI 研究。

1426

mmBERT:ModernBERT 走向多語言化

Hugging Face 推出 mmBERT,一個在 3 兆以上 token、涵蓋 1,800 多種語言的超大規模多語言編碼模型,於效能與推論速度上均優於 XLM-R。

1427

OpenAI 以人為本 AI 基金

OpenAI 已開放申請 5,000 萬美元基金,提供無限制補助金給美國非營利組織,以推動 AI 素養、社區創新與經濟機會。

1428

Anthropic 支持加州 SB 53

Anthropic 已支持加州參議院第 53 號法案 (SB 53),這是一個針對強大 AI 系統的監管框架,優先考慮透明度與披露,而非指令式的技術指令。

1429

OpenAI 研究:為何語言模型會產生幻覺

OpenAI 主張,語言模型產生幻覺是因為標準的訓練與評估程序傾向獎勵猜測而非承認不確定性,而非源於神祕的錯誤。

1430

OpenAI for Greece 合作夥伴關係啟動教育試點與 AI 加速器

OpenAI 宣佈了 ‘OpenAI for Greece’ 合作夥伴關係,於中學啟動 ChatGPT Edu 試點並設立希臘 AI 加速器以促進本地 AI 初創企業,標誌著在希臘教育與創新領域嵌入先進 AI 的重要一步。

1431

Anthropic 的 LLM 與生化風險:評估人工智慧驅動的生物威脅

Anthropic 宣布其 Claude Opus 4 模型現已啟用人工智慧安全等級 3 防護機制,以阻止協助生物武器開發,並詳細說明其關於人工智慧驅動生物風險與緩解策略的研究。

1432

OpenAI 透過 AI 計畫擴大經濟機會

OpenAI 宣布了 OpenAI Jobs Platform 與 OpenAI Certifications,協助員工提升 AI 流利度並與雇主接軌,目標在 2030 年前認證 1,000 萬名美國人。

1433

EmbeddingGemma 300M 版本說明

Google 發布了 EmbeddingGemma,一款 308M 參數的多語言嵌入模型,在 500M 以下模型的 MTEB 基準測試中名列前茅,且針對裝置端使用進行了優化。

1434

Anthropic 更新區域銷售限制以防止對手存取

Anthropic 正在加強其服務條款,以禁止受不支持區域(例如中國)控制的公司存取其服務,無論其子公司在何處註冊成立。

1435

Anthropic 加入白宮 AI 教育承諾

Anthropic 已承諾透過在 K-12 網路安全領域投資 100 萬美元、支持總統 AI 挑戰賽,以及為教育工作者推出 Creative Commons AI Fluency 教學課程,來擴大 AI 教育的普及機會。

1436

SandboxAQ SAIR 資料集發布

SandboxAQ 已發布 SAIR,這是目前最大規模的共摺疊 3D 蛋白質‑配體結構資料集,配有實驗測得的 IC50 標籤,提供超過 500 萬個 AI 生成的結構,以加速 AI 驅動的藥物發現。

1437

Mistral AI Le Chat Memories Beta Release

Mistral AI 為 Le Chat 推出了 Memories (beta),這是一個旨在強調透明度與使用者控制權的混合記憶系統,讓 AI 能夠在無需重新訓練的情況下,召回過去的對話與上傳的檔案。

1438

OpenAI 收購 Statsig 並任命 Vijaye Raji 為應用程式部門的首席技術官

OpenAI 收購了實驗平台 Statsig,並任命其創辦人兼執行長 Vijaye Raji 為應用程式部門的首席技術官,負責領導 ChatGPT 與 Codex 的產品工程。

1439

OpenAI 更新 ChatGPT 安全與福祉倡議

OpenAI 正在推行為期 120 天的計畫,以提升 ChatGPT 在精神健康危機中的回應,並在醫療專家網路的指導下為青少年推出家長控制功能。

1440

Mistral AI Le Chat 更新:MCP 連接器與記憶功能

Mistral AI 為 Le Chat 引入了由 MCP 驅動的連接器與「記憶 (Memories)」功能,實現了與 20 多種企業工具的無縫整合,並能在對話間維持個人化的上下文。

1441

Hugging Face ZeroGPU 前置編譯指南

Hugging Face 為 ZeroGPU Spaces 引入前置編譯(AoT),透過消除即時編譯開銷,使 Flux、Wan、LTX 等生成模型的速度提升 1.3 倍至 1.8 倍。

1442

Anthropic 系列 F 輪融資與估值更新

Anthropic 已由 ICONIQ 領投完成一輪 130 億美元的系列 F 融資,融資後估值達 1830 億美元,用以支持企業成長與安全研究。

1443

word2vec學習了什麼:特徵學習的閉式理論

BAIR研究人員提出了一個可預測的理論,證明word2vec的學習可簡化為無權重最小二乘矩陣分解,學得的表示實質上是對特定目標矩陣進行主成分分析(PCA)的結果。

1444

Anthropic Claude 3.5 Sonnet 電腦使用能力

Anthropic 已為 Claude 3.5 Sonnet 推出了公開測試版,讓該模型能透過移動游標、點擊與打字來直接與電腦螢幕互動,模擬人類的電腦互動方式。

1445

Claude 3.5 Sonnet 發佈說明 / 有什麼新功能

Anthropic 已發佈 Claude 3.5 Sonnet,該模型在推理與程式碼編寫基準測試中表現優於 Claude 3 Opus 與競爭對手,且運行速度是 Opus 的兩倍。

1446

Anthropic Clio 隱私保護分析工具

Anthropic 宣布推出 Clio,一個自動化且保護隱私的系統,能將真實世界中 Claude 的使用情況聚合為抽象主題聚類,以提升安全監控,同時不暴露使用者資料。

1447

OpenAI gpt-realtime 與 Realtime API 正式上線

OpenAI 已發布 gpt-realtime,一款高效能語音對語音模型,並正式開放 Realtime API,支援圖像輸入、遠端 MCP 伺服器與 SIP 電話呼叫。

1448

OpenAI 支持非營利組織與社區創新基金

OpenAI 正在開放申請一項 5,000 萬美元的基金,向美國境內的 501(c)(3) 非營利組織與社區組織提供無限制的補助金,以促進以 AI 為驅動的公共利益創新。

1449

Grok Code Fast 1 發佈說明 / 有什麼新功能

xAI 已發佈 grok-code-fast-1,這是一款針對速度、成本效益以及跨多種程式語言的代理式編碼工作流優化的全新模型架構。

1450

OpenAI 集體對齊與模型規範更新

OpenAI 推出了一項集體對齊研究計畫,將超過 1,000 名全球參與者的公共偏好納入其模型規範,以確保 AI 的預設行為能反映多元的人類價值觀。