✷ 封存 · 11 個實驗室 · 3,053 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
全球運算格局的轉移:中國在AI硬體與軟體的崛起
Hugging Face 分析美國出口管制如何悖論地加速了中國在國產AI晶片和計算效率高的開放權重模型的發展,從而創建了一個平行的AI基礎設施。
NVIDIA Isaac for Healthcare v0.4: 從模擬到部署構建醫療機器人
NVIDIA Isaac for Healthcare v0.4 推出一個端到端的工作流程,使用 SO-ARM 起始工作流程來構建自主手術助理,結合合成模擬數據與真實世界訓練。
OpenAI gpt-oss-safeguard 技術報告
OpenAI 已發布 gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b,這些是專門用於根據提供的政策進行內容分類的開放權重推理模型。
gpt-oss-safeguard 版本說明 / 新功能
OpenAI 已發布 gpt-oss-safeguard,一套專為安全分類任務設計的開放權重推理模型,允許開發者在推理時套用自訂政策。
Anthropic 研究:大型語言模型中出現的內省意識
Anthropic 研究指出,Claude 模型,特別是 Opus 4 和 4.1,展現出了一種有限但真實的能力,可以監控並控制其自身的內部神經狀態。
Anthropic 透過東京辦公室與 AI 安全夥伴關係擴張至日本
Anthropic 在東京開設了其在亞太地區的首個辦公室,並與 Japan AI Safety Institute 簽署了合作備忘錄,以建立國際 AI 評估標準。
OpenAI gpt-oss-safeguard 模型透過 Ollama 發佈
OpenAI 與 Ollama 發佈了採用 Apache 2.0 授權的開源 gpt-oss-safeguard 安全推理模型(20B 與 120B),讓組織能夠透過透明的推理過程來執行政策驅動的內容分類。
NVIDIA Isaac for Healthcare v0.4 發布
NVIDIA Isaac for Healthcare v0.4 引入了一個開發者框架與 SO-ARM 入門工作流程,讓 AI 醫療機器人的端對端開發從模擬到實際部署皆得以實現。
大日本印刷(DNP)ChatGPT Enterprise 部署成果
大日本印刷(DNP)在十個核心部門部署 ChatGPT Enterprise 後,達成每週活躍使用率 100% 以及專利研究時間縮減 95%。
IBM Granite 4.0 Nano 版本說明
IBM 已發布 Granite 4.0 Nano,這是一系列專為邊緣和設備端應用設計的高性能小型語言模型(SLMs),採用 Apache 2.0 授權。
Doppel AI 防禦系統:使用 GPT-5 和 o4-mini 自動化威脅偵測
Doppel 已部署一個使用 OpenAI 的 GPT-5 和 o4-mini 模型的 AI 驅動防禦系統,以自動化偵測和移除冒充網站和釣魚攻擊,將響應時間從小時縮短至分鐘。
OpenAI 公司重新資本化與 OpenAI 基金會的成立
OpenAI 已完成公司重新資本化,成立 OpenAI 基金會作為一個非營利組織,控制營利的 OpenAI Group PBC,以確保通用人工智慧(AGI)造福全人類。
Microsoft 與 OpenAI 合作夥伴更新 2025
Microsoft 與 OpenAI 已簽署一項新的最終協議,將 OpenAI 轉型為公共利益公司,並更新 IP 權利、AGI 驗證及計算協議。
Hugging Face 語音克隆與同意
Hugging Face 已推出語音同意閘門,這是一種系統基礎設施,要求說話者透過錄製的語句明確表達同意,之後語音克隆模型才能被啟動。
MiniMax M2 在 Ollama Cloud 上發布
MiniMax M2 是一款針對程式碼編寫與代理型工作流優化的高效能模型,現已在 Ollama 的雲端平台上線。
OpenAI 策略 為 US AI 領導力 和 能源 基礎設施
OpenAI 倡導一項國家項目,每年建設 100 吉瓦的新能源容量,以維持美國在人工智慧上的領導地位,並避免與中國的電子缺口。
GPT-5 系統卡片附錄:敏感對話
OpenAI 已更新 GPT-5,以更好地識別和支援處於情緒困境中的使用者,透過與超過 170 位心理健康專家合作,將次佳回應減少 65-80%。
OpenAI 加強 ChatGPT 對敏感對話的回應
OpenAI 已更新 ChatGPT 的預設模型(GPT-5),以更好地識別和支援處於困境中的使用者,使心理健康、自傷和情感依賴場景中的不當回應減少 65% 至 80%。
huggingface_hub v1.0: 五年打造開放機器學習的基礎
huggingface_hub 在五年後達到 v1.0,提供對超過 200 萬模型、50 萬資料集與 100 萬 Spaces 的核心存取,同時引入了如 httpx、hf_xet 與重新設計的 CLI 等重大變更,以支援未來十年的開放機器學習。
Hugging Face 串流資料集更新
Hugging Face 已優化 datasets 函式庫的串流功能,將啟動請求減少 100 倍,並將資料解析速度提升 10 倍,以實現無需本地下載即可高效訓練多 TB 資料集。
Steuerrecht.com 案例研究:使用 ChatGPT Business 擴展法律分析
Steuerrecht.com 使用 ChatGPT Business 自動化常規法律起草、研究和多語言溝通,將某些任務從天數縮短到分鐘,並且每位律師每週可節省多達 10 小時的工作時間。
推進 Claude 金融服務應用
Anthropic 已透過新的 Excel 插件、即時市場資料連接器,以及針對複雜財務建模與分析的專用 Agent Skills,擴展 Claude 金融服務功能。
T5Gemma: 透過僅解碼器適應的編碼器-解碼器 LLM
Google DeepMind 推出 T5Gemma,一系列透過適應預訓練的僅解碼器 Gemma 2 模型而建立的編碼器-解碼器模型,以提升推理效率和推理性能。
MedGemma 與 MedSigLIP 發布說明
Google DeepMind 已發布 MedGemma 與 MedSigLIP,這是一系列開放的多模態模型,旨在為醫療與生命科學 AI 開發提供高效能且保護隱私的基礎。
Gemma 3n 版本說明 / 新功能
Google DeepMind 已發布 Gemma 3n,這是一個以行動為優先的多模態模型系列,具備巢狀 MatFormer 架構,可實現彈性推理並在邊緣設備上達到高效能。
Gemini 2.5 Flash-Lite 版本說明
Google DeepMind 已發布 Gemini 2.5 Flash-Lite 的穩定版本,這是 Gemini 2.5 系列中最快且最具成本效益的模型,擁有 100 萬個 token 的上下文視窗和原生推理能力。
Google DeepMind Veo:將生成式影片整合至實景拍攝《ANCESTRA》
Google DeepMind 與導演 Eliza McNitt 以及 Darren Aronofsky 的 Primordial Soup 合作製作短片《ANCESTRA》,展示了 Veo 如何透過個人化生成與動作匹配,將生成式影片與實景畫面融合。
AlphaEarth Foundations:統一的地理空間嵌入,用於全球製圖
Google DeepMind 推出 AlphaEarth Foundations,一款將 PB 級多模態地球觀測資料整合為統一數位嵌入的 AI 模型,旨在革新全球製圖與環境監測。
Mistral AI Studio: 企業級 AI 生產平台
Mistral AI 推出了 AI Studio,這是一個生產級平台,旨在通過可觀測性 (Observability)、Agent Runtime 與 AI Registry 三大核心支柱,將企業級 AI 從原型開發轉向可靠且受治理的系統。
DeepMind Backstory 圖像來源與可信度實驗工具
Google DeepMind 宣佈了 Backstory,一款使用 Gemini 模型的實驗性 AI 工具,可揭示圖像的 AI 生成狀態、來源、修改以及不斷演變的情境,協助使用者評估其可信度。
Gemini Deep Think 在 IMO 2025 獲得金牌標準
Gemini 的進階版 Deep Think 解決了六題國際數學奧林匹克中的五題,獲得 35 分,達到金牌標準。
Google DeepMind Aeneas:古代銘文情境化的 AI
Google DeepMind 推出了 Aeneas,這是首個旨在透過多模態分析與平行文本檢索,協助歷史學家詮釋、歸屬與修復斷裂拉丁銘文的 AI 模型。
Genie 3 實時世界模型發布
Genie 3 是 DeepMind 的新實時世界模型,能以 24 fps 生成互動式 720p 環境,並在數分鐘內保持一致性,促進先進的具身代理研究。
Google DeepMind Perch 更新:推進瀕危物種的生物聲學
Google DeepMind 發布了更新的開源 Perch 模型,提升了鳥類物種預測的準確度,並將生物聲學分析擴展至哺乳動物、兩棲動物以及珊瑚礁等水下環境。
Google DeepMind 深度迴路塑形於 LIGO 引力波觀測站
Google DeepMind 推出深度迴路塑形,一種 AI 方法,可將 LIGO 反饋系統的控制噪聲降低 30 至 100 倍,從而實現更精確的引力波偵測。
Gemini 2.5 Deep Think ICPC 世界總決賽表現
Gemini 2.5 Deep Think 的進階版本在 2025 年國際大學生程式設計競賽(ICPC)世界總決賽中達到金牌等級的表現,解決了 12 題中 10 題複雜的演算法問題。
Google DeepMind 使用 AI 發現流體動力學新奇異點
Google DeepMind 開發了一種新穎的 AI 方法,利用物理資訊神經網路(PINNs)在流體動力學方程式中發現不穩定奇異點的新族群,為解決長期以來的數學挑戰提供了一條道路。
LeRobot v0.4.0 發行說明 / 新功能
Hugging Face 發佈了 LeRobot v0.4.0,推出可擴展的 Datasets v3.0、如 PI0.5 與 GR00T N1.5 的 VLA 模型,以及用於簡化硬體整合的插件系統。
Google DeepMind 前沿安全框架更新
Google DeepMind 發布了其前沿安全框架(FSF)的第三版,引入了針對有害操控和不對齊 AI 的新風險領域,並新增了可追蹤能力層級(TCL)以更早偵測風險。
Gemini Robotics 1.5 與 Gemini Robotics-ER 1.5 發布
Google DeepMind 推出了 Gemini Robotics 1.5 與 Gemini Robotics-ER 1.5,這兩款模型結合了高階具身推理與直接的視覺語言行動控制,使機器人能執行複雜的多步實體任務。
Google DeepMind CodeMender AI 代理程式,用於程式碼安全
Google DeepMind 推出了 CodeMender,一個 AI 驅動的代理程式,能自動識別、修補並主動保護開源專案中的軟體漏洞。
Google DeepMind 與 Commonwealth Fusion Systems 合作推動核融合能源
Google DeepMind 正與 Commonwealth Fusion Systems 合作,運用 AI、強化學習與 TORAX 模擬器,加速在 SPARC 托卡馬克中實現淨核融合能量的目標。
Gemini 2.5 Deep Think 發布
Google DeepMind 已在 Gemini 應用程式中為 Google AI Ultra 訂閱者推出 Deep Think,並引入平行思考技術,以提升在程式設計、科學與數學領域的複雜問題解決能力。
Google DeepMind 與 Kaggle 推出 Game Arena 以評估 AI
Google DeepMind 與 Kaggle 推出了 Game Arena,一個開源平台,透過策略遊戲的正面對決評估 AI 模型,以提供可驗證的一般問題解決智慧衡量指標。
OpenAI 收購 Software Applications Incorporated 以將 Sky 整合至 ChatGPT
OpenAI 已收購 Sky 的創作者 Software Applications Incorporated,將深度 macOS 整合與自然語言介面納入 ChatGPT。
Consensus Scholar Agent:使用 GPT-5 與 Responses API 的研究自動化
Consensus 推出了 Scholar Agent,一個由 GPT-5 與 Responses API 驅動的多代理系統,能自動合成超過 2.2 億篇同行評審文獻。
Hugging Face 與 Meta 推出 OpenEnv 以支援代理環境
Hugging Face 與 Meta 已推出 OpenEnv 與 OpenEnv Hub,這是一個標準化、開放的社群中心,提供安全、沙盒化的代理環境,用於訓練與部署。
OpenAI 推出適用於 ChatGPT Business、Enterprise 與 Edu 的 Company Knowledge 功能
OpenAI 推出適用於 ChatGPT Business、Enterprise 與 Edu 的 Company Knowledge,讓使用者能透過 GPT‑5 模型查詢 Slack、Google Drive 等內部工具,並提供引用,同時確保資料私密。
OpenAI 南韓經濟藍圖
OpenAI 已發布針對南韓的經濟藍圖,提出結合主權 AI 能力與策略性前沿 AI 合作的雙軌策略,以提升國家生產力。
Anthropic 宣布在首爾開設新辦公室以擴大亞太地區佈局
Anthropic 將於 2026 年初在首爾開設辦公室,以支持韓國市場的快速增長,該國 Claude Code 的使用量在四個月內增長了六倍。