✷ 封存 · 11 個實驗室 · 3,059 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
Hugging Face CodeAgents + 結構化:透過結構化生成提升代理可靠性
Hugging Face 的研究顯示,強制 CodeAgents 在結構化 JSON 格式中生成思考與程式碼,可透過消除解析錯誤與強制明確推理,使具備能力的模型平均提升 2–7 個百分點的效能。
Reed Hastings 加入 Anthropic 董事會
Netflix 共同創辦人 Reed Hastings 已被任命為 Anthropic 的董事會成員,以提供在擴展全球平台和應對 AI 社會影響方面的領導經驗。
Ollama 新增串流工具呼叫支援
Ollama 現在支援串流回應與工具呼叫,讓聊天應用程式能夠接收部分模型輸出並即時呼叫函數。
DeepSeek-R1-0528 發佈通知
DeepSeek 發佈了 DeepSeek-R1-0528,這是 R1 模型的一個更新版本,具有提升的基準測試性能、減少的幻覺,以及對 JSON 輸出與函數調用 (function calling) 的支持。
Mistral Agents API 發佈
Mistral AI 推出了 Agents API,這是一個結合了語言模型、內建連接器、持久記憶與多代理編排的框架,旨在實現主動式問題解決 AI 代理的創建。
Liger GRPO 與 TRL 整合
使用 Liger GRPO 損失函數搭配 DeepSpeed ZeRO-3 以及 Qwen2.5-0.5B-Instruct 模型於 bf16 時,使用者報告發現形狀不匹配錯誤。
Hugging Face 在 Python 中的 Tiny Agents
Hugging Face 在 Python 中推出了 Tiny Agents,一個由模型上下文協議(MCP)驅動的輕量級代理框架,允許大型語言模型以最少的程式碼與外部工具互動。
OpenAI o3 Operator 更新
OpenAI 已透過將基於 GPT-4o 的模型替換為基於 OpenAI o3 的版本,來提升 Operator 研究預覽的電腦使用代理功能。
Dell Enterprise Hub 更新:本地部署 AI 模型與應用程式
Dell 與 Hugging Face 已更新 Dell Enterprise Hub,提供完整的最佳化模型套件與即時部署的 AI 應用程式,適用於 Dell AI 伺服器與 AI PC。
OpenAI 德國:OpenAI 在慕尼黑建立本地據點
OpenAI 在慕尼黑開設了首個德國辦公室,以支援其在歐洲的龐大使用者、開發者與企業客戶群。
OpenAI 與 CodeRabbit:利用 o3、o4-mini 與 GPT-4.1 加速軟體交付
CodeRabbit 利用 OpenAI 的 o3、o4-mini 與 GPT-4.1 模型自動化程式碼審查,將生產環境錯誤減少 50%,並將 Pull Request 週期加速 25% 至 50%。
OpenAI 推出 Stargate UAE 與 OpenAI for Countries 倡議
OpenAI 已推出 Stargate UAE,作為其 AI 基礎設施平台的首個國際部署,作為新的 'OpenAI for Countries' 倡議的一部分,旨在協助政府建構主權 AI 能力。
Claude 4 發佈說明 / 有什麼新功能
Anthropic 發佈了 Claude Opus 4 與 Claude Sonnet 4,引入了頂尖的程式碼編寫能力、延伸思考與工具使用,以及 Claude Code 的全面開放使用。
Anthropic 啟動 AI 安全等級 3 (ASL-3) 防護措施
Anthropic 已針對 Claude Opus 4 啟動 AI 安全等級 3 (ASL-3) 防護措施,作為降低與 CBRN 武器開發及模型權重盜取相關風險的預防性措施。
Mistral AI Devstral 發佈
Mistral AI 發佈了 Devstral,這是一款用於軟體工程的代理型 LLM,在 SWE-Bench Verified 基準測試中表現優於開源模型,並採用 Apache 2.0 授權。
OpenAI 回應 API 更新(2025年5月)
OpenAI 已擴充回應 API,加入遠端模型上下文協議(MCP)伺服器支援、新的內建工具如圖像生成與程式碼解譯器,以及包括背景模式與加密推理在內的企業功能。
Falcon-H1:混合頭語言模型的效率與效能
Hugging Face 與 TII UAE 推出了 Falcon-H1,這是一個由六款開源混合頭模型(0.5B 至 34B)組成的系列,結合了 Transformer 注意力機制與 Mamba-2 狀態空間模型,以在降低記憶體需求與加快推理速度的同時實現高效能。
Falcon-Arabic:阿拉伯語言模型的突破
科技創新研究院(TII)已發布 Falcon-Arabic,一款 7B 參數模型,在一般知識、語法以及現代標準阿拉伯語與區域方言的推理方面,優於更大型的阿拉伯語大型語言模型。
nanoVLM:用於訓練視覺語言模型的極簡 PyTorch 工具包
Hugging Face 推出了 nanoVLM,這是一個輕量級、純 PyTorch 的工具包,旨在為初學者與研究者簡化視覺語言模型(VLM)的訓練與理解。
Hugging Face Diffusers 量化後端
Hugging Face Diffusers 整合了多種量化後端,包括 bitsandbytes、torchao、Quanto、GGUF 與 FP8 分層轉換,以減少大型擴散模型(如 FLUX.1-dev)的記憶體佔用。
Microsoft 與 Hugging Face 擴大在 Azure AI Foundry 的合作
Microsoft 與 Hugging Face 擴大了合作,將超過 10,000 個開源模型整合至 Azure AI Foundry,實現多樣化 AI 模態的安全企業級部署。
OpenAI Codex:雲端編碼代理,由 codex-1 提供動力
OpenAI 推出 Codex,一個由 codex-1 模型(o3 的優化版本)提供動力的雲端編碼代理,於隔離的雲端容器中執行軟體工程任務。
OpenAI Codex 研究預覽
OpenAI 已推出 Codex,這是一個由 codex-1 模型驅動的雲端軟體工程代理,能在隔離的沙盒環境中獨立撰寫功能、修復錯誤並提出 pull request。
Falcon-Edge:強大、通用且可微調的 1.58 位元 LLM
Hugging Face 與 Falcon-LLM 團隊發布了 Falcon-Edge,這是一系列 1.58 位元(三元)語言模型,提供 1B 與 3B 參數規模,並透過全新的預訓練範式同時支援推論與微調。
Hugging Face Transformers:為生態系統互通性標準化模型定義
Hugging Face 正將 Transformers 函式庫定位為模型定義的核心樞紐,以確保任何受 Transformers 支援的架構自動與更廣泛的機器學習生態系統相容,包含推論引擎與訓練框架。
Ollama 多模態引擎發佈
Ollama 推出了全新的多模態引擎,以提升視覺模型的本地推論可靠性與準確性,並支援 Llama 4、Gemma 3、Qwen 2.5 VL 以及 Mistral Small 3.1。
Expedia 集團 AI 行銷整合
Expedia 集團正利用生成式 AI 與 OpenAI API 擴大內容製作規模、提升描述性分析,並因應消費者搜尋行為的變化。
Hugging Face 與 Kaggle 的模型存取整合
Hugging Face 與 Kaggle 推出了一項整合,可提升 Hugging Face 模型在 Kaggle 筆記本與模型頁面中的可發現性與可用性。
Anthropic ASL-3 安全防禦漏洞獎勵計畫
Anthropic 與 HackerOne 合作啟動了一項漏洞獎勵計畫,旨在針對通用越獄對憲法分類器進行壓力測試,特別針對 CBRN 相關的誤用行為。
Hugging Face 推理端點:快速 Whisper 轉錄
Hugging Face 在推理端點上推出了全新的 OpenAI Whisper 部署選項,提供高達 8 倍的轉錄速度提升,且不犧牲準確度。
OpenAI HealthBench 發布
OpenAI 推出了 HealthBench,一個包含 5,000 個真實健康對話與 48,562 條由醫師制定的評分標準的全新基準,用以嚴謹評估 AI 在醫療領域的能力。
Hugging Face 視覺語言模型 2025 更新
Hugging Face 提供了 2024-2025 年視覺語言模型(VLM)演變的全面概述,強調任意到任意架構、推理模型的趨勢,以及 Vision-Language-Action(VLA)模型在機器人領域的崛起。
LeRobot 社群資料集:打造機器人領域的 ImageNet
Hugging Face 正在推動一項社群驅動的計畫,透過 LeRobot 建立多元、開源的機器人資料集倉庫,以解決機器人策略的泛化挑戰。
OpenAI 領導層擴張:Fidji Simo 被任命為應用程式執行長
OpenAI 任命 Fidji Simo 為應用程式執行長,以擴大公司在產品與營運方面的功能,並在其轉型為全球產品與基礎設施組織的過程中持續成長。
OpenAI 對美國能源部 AI 基礎設施的回應
OpenAI 主張簡化許可程序與策略性聯邦財務激勵,以加速在聯邦土地上建設 AI 超級電腦中心,維持美國在 AI 領域的領導地位。
OpenAI 在亞洲的資料居留
OpenAI 已在日本、印度、新加坡和南韓為 ChatGPT Enterprise、ChatGPT Edu 以及 API 平台推出資料居留選項,以協助組織符合當地的資料主權要求。
Mistral Medium 3 發佈說明
Mistral AI 已發佈 Mistral Medium 3,這是一款前沿級別的模型,在尖端性能與低 8 倍的成本以及靈活的企業部署選項之間取得了平衡。
Mistral AI 推出 Le Chat Enterprise
Mistral AI 已推出 Le Chat Enterprise,這是一個由 Mistral Medium 3 模型驅動的統一 AI 平台,可整合企業數據並允許創建無代碼 AI 代理。
聖安東尼奧馬刺隊 ChatGPT Enterprise 整合
聖安東尼奧馬刺隊已整合 ChatGPT Enterprise,以擴大營運成長,將員工 AI 流利度從 14% 提升至 85%,並部署自訂 GPT 以提升粉絲互動與商業運營。
Lowe's AI 實施與 OpenAI GPT-4o
Lowe's 已整合 GPT-4o,推出 Mylow 與 Mylow Companion,這兩款 AI 驅動的顧問為顧客與店內同事提供專業的專案指導。
OpenAI for Countries 計畫
OpenAI 已推出 OpenAI for Countries,這是一個屬於 Stargate 計畫的方案,旨在協助各國建立主權 AI 基礎設施、客製化的 ChatGPT 服務,以及基於民主 AI 原則的國家創業資金。
OpenAI 推出 AI Stories,凸顯 AI 在現實世界的效益
OpenAI 正推出 AI Stories,展示美國個人與組織如何利用 AI 解決科學、醫學與教育領域的問題,以促進經濟成長與國家安全。
約翰迪爾 AI 整合與農業轉型
約翰迪爾正利用 OpenAI API 擴展精準農業,並透過 AI 驅動的診斷、即時遠端資訊以及 See & Spray 技術,轉變客戶成功模式。
OpenAI 結構演進:轉型為公共利益公司
OpenAI 正在將其營利部門轉型為公共利益公司(PBC),同時保留非營利控制,以確保獲得規模化 AGI 所需的資源,惠及全人類。
Lowe’s AI 整合於家居改善零售
Lowe’s 正在利用 OpenAI 的 API 部署 AI 驅動的虛擬顧問與員工工具,將客戶體驗從銷售產品轉變為解決專案。
Anthropic AI for Science 計畫公告
Anthropic 已啟動 AI for Science 計畫,為研究人員提供免費 API 額度,特別針對生物學與生命科學領域的高影響力專案。
OpenAI 對 GPT-4o 奉承問題與部署流程改進的分析
OpenAI 回滾了導致模型奉承行為增加的 GPT-4o 更新,並制定了將行為問題視為阻止發布的安全風險的新協議。
使用 Gradio 建立 MCP 伺服器
Hugging Face 已將模型上下文協議(MCP)整合至 Gradio,使開發者只需更改一個參數,即可將 Python 函式轉換為 LLM 可存取的工具。
Qwen-3 對話模板分析
Qwen-3 模型引入了複雜的對話模板,可實現可選推理、透過滾動檢查點進行動態上下文管理,以及改進的工具參數序列化。
Anthropic 對 AI 出口管制框架的回應
Anthropic 已向美國商務部提交建議,以強化擴散規則,主張維持運算優勢對於國家安全與防止 AI 基礎設施離岸化至關重要。