151

OpenAI Academy 課程:在工作中推動 AI 採用

OpenAI 推出了三門新課程——AI 基礎、應用 AI 基礎與代理與工作流程——旨在協助組織建立 AI 流利度,並將個別任務的改進轉化為結構化、由代理協助的工作流程。

152

MiniMax M3 vLLM 支援:面向 1M 令牌多模態推理的 Day-0 服務

vLLM 已發布對 MiniMax M3 模型系列的 day-0 支援,使得能夠使用 MiniMax 稀疏注意力 (MSA) 高效服務 1M 令牌上下文與原生多模態推理。

153

Preply 與 OpenAI:以 AI 個人化語言學習

Preply 已整合 OpenAI API,打造課程洞察,這項工具透過自動化回饋與針對性練習,將 1 對 1 人類導師課程轉化為個人化的學習旅程。

154

在 PyTorch 中的效能分析(第 2 部分):從 nn.Linear 到融合的 MLP

Hugging Face 說明了如何透過分析 GPU kernel 融合、`torch.compile` 的影響,以及使用 `kernels` 函式庫的手工調校 kernel,來最佳化 PyTorch 中的多層感知器(MLP)。

155

OpenAI 收購 Ona 以實現 Codex 的持續雲端執行

OpenAI 正在收購 Ona,將安全雲端執行與協調技術整合至 Codex,使 AI 代理能獨立於使用者的即時會話,執行複雜且長時間的任務。

156

OpenAI 支持歐盟 AI 生成內容透明度實踐守則

OpenAI 宣布支持歐洲委員會的《AI 生成內容透明度實踐守則》,以落實《歐盟 AI 法案》並提升數位內容來源的透明度。

157

使用 OpenAI Codex 加速黑洞等離子體模擬

天體物理學家 Chi-kwan Chan 正使用 OpenAI Codex 推導並測試新的數值演算法,以降低模擬黑洞周圍粒子運動的計算開銷。

158

BBVA 與 OpenAI 針對 AI 原生銀行的戰略合作

BBVA 已與 OpenAI 形成戰略聯盟,將人工智慧整合到其全球營運中,將 ChatGPT Enterprise 的規模擴大至 100,000 名員工,並實施了一個名為「The Eight」的全面 AI 轉型路線圖。

159

OpenAI 與 Oracle Cloud Infrastructure 整合

OpenAI 與 Oracle 正在合作,以允許 Oracle Cloud Infrastructure (OCI) 客戶將符合資格的 Oracle Universal Credits 用於 OpenAI 前沿模型和 Codex 的使用。

160

DiffusionGemma: 透過文字擴散實現 4 倍更快的文字生成

Google DeepMind 已發布 DiffusionGemma,這是一個實驗性的 26B MoE 模型,利用文字擴散同時生成文本塊,相較於自回歸模型,在專用 GPU 上可實現最高 4 倍更快的推理。

161

OpenAI 阻斷與中國相關的影響行動,針對美國 AI 辯論

OpenAI 已封禁兩個與中國相關的 ChatGPT 帳號叢集,這些帳號利用 AI 秘密操縱有關 AI 基礎設施和技術政策的美國公開辯論。

162

Google DeepMind 多智能體 AI 安全研究資助計畫

Google DeepMind 與其合作夥伴宣布了一項 1,000 萬美元的資助計畫,以研究大規模多智能體 AI 系統的安全與穩定性,以緩解由互動的獨立代理產生的新興風險。

163

DiffusionGemma: 首個原生支援於 vLLM 的擴散 LLM

vLLM 已整合 DiffusionGemma,這是一個 26B 參數離散擴散語言模型,透過迭代去噪 token 區塊而非序列自回歸解碼,實現高吞吐量、低延遲的生成。

164

LSEG 透過 OpenAI 整合擴展受信任的 AI

倫敦證券交易所集團(LSEG)已整合 ChatGPT Enterprise 和 OpenAI API,以將產品發布週期從月份縮短至週數,並提升全球員工生產力。

165

Gemini 3.5 Live Translate 發行說明

Google DeepMind 已發布 Gemini 3.5 Live Translate,一種音訊模型,可為超過 70 種語言提供近乎即時的語音對語音翻譯,同時保持說話者的語調和音高。

166

Gemma 4 12B 版本說明 / 新功能

Google DeepMind 已發布 Gemma 4 12B,一種專為在配備 16GB RAM 的筆電上本地執行而設計的無編碼器多模態模型,具備原生音訊與視覺處理。

167

Google DeepMind Accelerator: 機器人計畫啟動

Google DeepMind 在歐洲推出機器人加速器,選出 15 家早期階段初創公司,提供三個月的技術支援及存取 Gemini 機器人模型。

168

Nextdoor 工程整合 OpenAI Codex

Nextdoor 利用 OpenAI Codex 和 GPT-5.5 使個別工程師能夠實現端到端的產品擁有權,將工程瓶頸從實現轉移到戰略規劃。

169

Hugging Face Spaces agents.md 實現自動化 3D 多媒體管線

一個編碼代理透過串聯兩個現有的 Spaces,自動構建了一個展示巴黎古蹟 3D Gaussian splats 的靜態 Hugging Face Space,展示了 `agents.md` 如何將任何 Space 轉化為多媒體管線中可組合的構建模組。

170

OpenAI Codex 在 Notion 的整合

Notion 正在使用 OpenAI Codex 自動化功能開發,使工程師和經理能夠在數小時而非數週內交付可投入生產的程式碼。

171

OpenAI 智慧時代產業政策

OpenAI 已提出一套以人為本的產業政策想法,以確保超智能的利益能廣泛分享,並啟動了一項補助金計畫來支援相關研究。

172

將 GitHub CI 遷移至 Hugging Face Jobs

Hugging Face 提供一種在無伺服器 Hugging Face Jobs 基礎設施上執行 GitHub Actions 的方法,啟用 GPU 加速的 CI,並將 CPU 工作執行時間減少多達 30%。

173

vime RL Framework 發布

vLLM 推出 vime,一個開源的 RL 後訓練框架,整合 Megatron 訓練與 vLLM 推理,以提供穩定且高效的管線用於 LLM 強化學習。

174

OpenAI 機密 S-1 提交

OpenAI 已向 SEC 提交機密的 S-1 草案,提供公司選擇成為公開公司的選項,同時保持私人狀態以追求特定目標。

175

Google DeepMind Guided Learning AI 在塞拉利昂的試驗

塞拉利昂的一項預先註冊試驗表明,由 AI 驅動的 Guided Learning 可在八週內將數學學習進度提升最多相當於通常進度的 2.5 年,前提是該工具作為教師主導的增強工具使用。

176

OpenAI 通用人工智慧分配與發展的戰略計畫

OpenAI 已宣布一項戰略計畫,以確保通用人工智慧(AGI)造福全人類,重點放在自動化 AI 研究、經濟加速以及向地球上每個人提供個人化 AGI。

177

OpenEnv: 標準化開源 AI 的代理人強化學習環境

Hugging Face 已將 OpenEnv 過渡為社群協調專案,以作為代理人強化學習環境的互操作層。

178

OpenAI 經濟研究交流平台啟動

OpenAI 已啟動經濟研究交流平台,以向外部研究者提供 OpenAI 工具和數據集的存取權,產出關於 AI 對經濟影響的獨立實證證據。

179

vLLM Semantic Router v0.3 Themis 發佈說明

vLLM Semantic Router v0.3 Themis 引入了狀態化生產級路由,具備會話感知代理路由 (SAAR)、規範的配置規範,以及對 AMD ROCm 和 Intel OpenVINO 擴展的硬體支援。

180

NVIDIA Nemotron 3.5 內容安全發佈

NVIDIA 發佈了 Nemotron 3.5 Content Safety,這是一個 4B 參數的多模態、多語言安全模型,具備自定義策略執行能力和可選的推理軌跡,適用於企業級 AI。

181

Endava AI 整合:使用 OpenAI Agents 重新設計軟體交付

Endava 已將 OpenAI 技術整合到其 11,000 人的員工隊伍中,以重新設計軟體交付和運營工作流程,將 AI 從生產力工具轉變為核心運營模型。

182

ChatGPT 做夢 記憶 更新

OpenAI 已推出一種基於 '做夢' 的更強大且計算效率更高的記憶架構,以改進 ChatGPT 如何合成、更新和回顧使用者的情境、偏好以及時間敏感資訊。

183

OpenAI 生物防禦在智慧時代的行動計畫

OpenAI 已啟動一項生物防禦行動計畫,透過為負責任的防禦者配備先進的 AI 能力來增強生物韌性,特別利用 GPT-Rosalind 模型。

184

Hugging Face hf CLI 針對代理優化的重新設計,降低了 Token 使用量並提升了成功率

Hugging Face 宣布對 hf CLI 進行了針對代理優化的重新設計,這能為 Claude Code 和 Codex 等編碼代理減少高達 6 倍的 Token 使用量,並提高成功率。

185

NVIDIA Nemotron 3 Ultra 支援於 vLLM

vLLM 宣布對 NVIDIA Nemotron 3 Ultra 提供 Day-0 支援,這是一個 550B 參數模型,透過混合 Transformer-Mamba MoE 架構,針對長時間運行的自主代理工作流程進行優化。

186

GPT-Rosalind 更新:增強生命科學能力與研究工具

摘要: OpenAI 已更新 GPT-Rosalind,整合了 GPT-5.5 的具代理能力以及在醫藥化學、基因組學和濕實驗故障排除方面的專門智能,以服務於企業規模的生命科學研究。

187

直接偏好優化:超越聊天機器人

提供的來源材料是來自 Hugging Face 的 429 速率限制錯誤頁面,且不包含有關 Direct Preference Optimization 的任何技術內容。

188

Wasmer 如何使用 Codex 建置適用於邊緣的 Node.js 執行時環境

Wasmer 使用 OpenAI 的 Codex 開發 Edge.js,這是一個能夠在 WebAssembly 沙盒中執行 Node.js 工作負載的 JavaScript 執行時環境,將開發時間從估計的一年縮短至兩週。

189

OpenAI 前沿 AI 民主治理藍圖

OpenAI 已發布一項藍圖,提出一個三部分的聯邦框架,供美國透過國家標準化、加強 CAISI 以及全政府韌性計畫來治理日益增強的 AI 系統。

190

OpenAI 公共政策議程

2026年6月3日,OpenAI 發布了其公共政策議程,概述了其使命、原則以及在安全、青少年保護、教育、勞動力轉型、深偽和 AI 基礎設施方面的政策優先事項。

191

Fast & Efficient LLM Inference with vLLM 課程發布

vLLM 與 DeepLearning.AI 和 Red Hat 合作,推出了一個免費的中級課程,名為 Fast & Efficient LLM Inference with vLLM,旨在教授完整的 AI 部署生命週期。

192

Hugging Face 速率限制阻止訪問 'Adding MCP Tools to Reachy Mini' 貼文

Hugging Face 指向博客文章 'Adding MCP Tools to Reachy Mini' 的連結返回 429 速率限制錯誤,因此無法摘要任何內容。

193

Holo3.1: 快速 & 本地電腦使用代理

提供的 Holo3.1 來源材料因 429 速率限制錯誤而不可用,且未提供任何技術細節。

194

Travelers 使用 OpenAI 部署 AI 驅動的理賠助理

Travelers 已經推出全國性的 AI 理賠助理,該助理由 OpenAI 的 Realtime API 提供動力,以自動化汽車財產損失理賠的首次損失通知,使得 85-90% 的使用者能夠自主完成理賠申報。

195

ChatGPT Sites: 建立內部頁面與輕量應用程式 透過 Codex

OpenAI 已推出 ChatGPT Sites,這是一項功能,允許使用者直接從 Codex 桌面應用程式建立、部署和分享內部網站與輕量互動應用程式。

196

Codex 適用於每個角色、工具與工作流程

OpenAI 宣布針對 Codex 推出新的角色專屬外掛、互動式網站以及就地註解,將其使用範圍擴展至開發者以外的分析師、行銷人員、銷售、投資者與銀行家。

197

OpenAI 青少年 AI 安全提案與全球領導力倡議

OpenAI 已提議成立一個國際青少年安全研究所,並制定了一套九點框架,以實現符合年齡的 AI 保護,這些內容將在 G7 領導人峰會上進行討論。

198

OpenAI Codex 擴展至知識工作

OpenAI 報告 Codex 已達到 500 萬週活躍用戶,知識工作者現在佔用戶基礎的 20%,增長速度是開發者的三倍。

199

vLLM Session-Aware Agentic Routing (SAAR) 發布

vLLM 推出 Session-Aware Agentic Routing (SAAR),這是一種模型選擇政策,透過在工具循環和提供者狀態過程中防止不安全的模型切換,來保持會話連續性並降低長時程 LLM 代理的成本。

200

vLLM-Omni 透過 AutoRound 量化加速推理

vLLM-Omni 現在整合了 Intel 的 AutoRound 訓練後量化技術,實現了 W4A16 量化,在保持準確度的同時,可減少高達 62% 的模型大小,並在 Intel XPU 和 NVIDIA GPU 上釋放性能增益。