OpenAI Academy 課程:在工作中推動 AI 採用
OpenAI 推出了三門新課程——AI 基礎、應用 AI 基礎與代理與工作流程——旨在協助組織建立 AI 流利度,並將個別任務的改進轉化為結構化、由代理協助的工作流程。
MiniMax M3 vLLM 支援:面向 1M 令牌多模態推理的 Day-0 服務
vLLM 已發布對 MiniMax M3 模型系列的 day-0 支援,使得能夠使用 MiniMax 稀疏注意力 (MSA) 高效服務 1M 令牌上下文與原生多模態推理。
Preply 與 OpenAI:以 AI 個人化語言學習
Preply 已整合 OpenAI API,打造課程洞察,這項工具透過自動化回饋與針對性練習,將 1 對 1 人類導師課程轉化為個人化的學習旅程。
在 PyTorch 中的效能分析(第 2 部分):從 nn.Linear 到融合的 MLP
Hugging Face 說明了如何透過分析 GPU kernel 融合、`torch.compile` 的影響,以及使用 `kernels` 函式庫的手工調校 kernel,來最佳化 PyTorch 中的多層感知器(MLP)。
OpenAI 收購 Ona 以實現 Codex 的持續雲端執行
OpenAI 正在收購 Ona,將安全雲端執行與協調技術整合至 Codex,使 AI 代理能獨立於使用者的即時會話,執行複雜且長時間的任務。
OpenAI 支持歐盟 AI 生成內容透明度實踐守則
OpenAI 宣布支持歐洲委員會的《AI 生成內容透明度實踐守則》,以落實《歐盟 AI 法案》並提升數位內容來源的透明度。
使用 OpenAI Codex 加速黑洞等離子體模擬
天體物理學家 Chi-kwan Chan 正使用 OpenAI Codex 推導並測試新的數值演算法,以降低模擬黑洞周圍粒子運動的計算開銷。
BBVA 與 OpenAI 針對 AI 原生銀行的戰略合作
BBVA 已與 OpenAI 形成戰略聯盟,將人工智慧整合到其全球營運中,將 ChatGPT Enterprise 的規模擴大至 100,000 名員工,並實施了一個名為「The Eight」的全面 AI 轉型路線圖。
OpenAI 與 Oracle Cloud Infrastructure 整合
OpenAI 與 Oracle 正在合作,以允許 Oracle Cloud Infrastructure (OCI) 客戶將符合資格的 Oracle Universal Credits 用於 OpenAI 前沿模型和 Codex 的使用。
DiffusionGemma: 透過文字擴散實現 4 倍更快的文字生成
Google DeepMind 已發布 DiffusionGemma,這是一個實驗性的 26B MoE 模型,利用文字擴散同時生成文本塊,相較於自回歸模型,在專用 GPU 上可實現最高 4 倍更快的推理。
OpenAI 阻斷與中國相關的影響行動,針對美國 AI 辯論
OpenAI 已封禁兩個與中國相關的 ChatGPT 帳號叢集,這些帳號利用 AI 秘密操縱有關 AI 基礎設施和技術政策的美國公開辯論。
Google DeepMind 多智能體 AI 安全研究資助計畫
Google DeepMind 與其合作夥伴宣布了一項 1,000 萬美元的資助計畫,以研究大規模多智能體 AI 系統的安全與穩定性,以緩解由互動的獨立代理產生的新興風險。
DiffusionGemma: 首個原生支援於 vLLM 的擴散 LLM
vLLM 已整合 DiffusionGemma,這是一個 26B 參數離散擴散語言模型,透過迭代去噪 token 區塊而非序列自回歸解碼,實現高吞吐量、低延遲的生成。
LSEG 透過 OpenAI 整合擴展受信任的 AI
倫敦證券交易所集團(LSEG)已整合 ChatGPT Enterprise 和 OpenAI API,以將產品發布週期從月份縮短至週數,並提升全球員工生產力。
Gemini 3.5 Live Translate 發行說明
Google DeepMind 已發布 Gemini 3.5 Live Translate,一種音訊模型,可為超過 70 種語言提供近乎即時的語音對語音翻譯,同時保持說話者的語調和音高。
Gemma 4 12B 版本說明 / 新功能
Google DeepMind 已發布 Gemma 4 12B,一種專為在配備 16GB RAM 的筆電上本地執行而設計的無編碼器多模態模型,具備原生音訊與視覺處理。
Google DeepMind Accelerator: 機器人計畫啟動
Google DeepMind 在歐洲推出機器人加速器,選出 15 家早期階段初創公司,提供三個月的技術支援及存取 Gemini 機器人模型。
Nextdoor 工程整合 OpenAI Codex
Nextdoor 利用 OpenAI Codex 和 GPT-5.5 使個別工程師能夠實現端到端的產品擁有權,將工程瓶頸從實現轉移到戰略規劃。
Hugging Face Spaces agents.md 實現自動化 3D 多媒體管線
一個編碼代理透過串聯兩個現有的 Spaces,自動構建了一個展示巴黎古蹟 3D Gaussian splats 的靜態 Hugging Face Space,展示了 `agents.md` 如何將任何 Space 轉化為多媒體管線中可組合的構建模組。
OpenAI Codex 在 Notion 的整合
Notion 正在使用 OpenAI Codex 自動化功能開發,使工程師和經理能夠在數小時而非數週內交付可投入生產的程式碼。
OpenAI 智慧時代產業政策
OpenAI 已提出一套以人為本的產業政策想法,以確保超智能的利益能廣泛分享,並啟動了一項補助金計畫來支援相關研究。
將 GitHub CI 遷移至 Hugging Face Jobs
Hugging Face 提供一種在無伺服器 Hugging Face Jobs 基礎設施上執行 GitHub Actions 的方法,啟用 GPU 加速的 CI,並將 CPU 工作執行時間減少多達 30%。
vime RL Framework 發布
vLLM 推出 vime,一個開源的 RL 後訓練框架,整合 Megatron 訓練與 vLLM 推理,以提供穩定且高效的管線用於 LLM 強化學習。
OpenAI 機密 S-1 提交
OpenAI 已向 SEC 提交機密的 S-1 草案,提供公司選擇成為公開公司的選項,同時保持私人狀態以追求特定目標。
Google DeepMind Guided Learning AI 在塞拉利昂的試驗
塞拉利昂的一項預先註冊試驗表明,由 AI 驅動的 Guided Learning 可在八週內將數學學習進度提升最多相當於通常進度的 2.5 年,前提是該工具作為教師主導的增強工具使用。
OpenAI 通用人工智慧分配與發展的戰略計畫
OpenAI 已宣布一項戰略計畫,以確保通用人工智慧(AGI)造福全人類,重點放在自動化 AI 研究、經濟加速以及向地球上每個人提供個人化 AGI。
OpenEnv: 標準化開源 AI 的代理人強化學習環境
Hugging Face 已將 OpenEnv 過渡為社群協調專案,以作為代理人強化學習環境的互操作層。
OpenAI 經濟研究交流平台啟動
OpenAI 已啟動經濟研究交流平台,以向外部研究者提供 OpenAI 工具和數據集的存取權,產出關於 AI 對經濟影響的獨立實證證據。
vLLM Semantic Router v0.3 Themis 發佈說明
vLLM Semantic Router v0.3 Themis 引入了狀態化生產級路由,具備會話感知代理路由 (SAAR)、規範的配置規範,以及對 AMD ROCm 和 Intel OpenVINO 擴展的硬體支援。
NVIDIA Nemotron 3.5 內容安全發佈
NVIDIA 發佈了 Nemotron 3.5 Content Safety,這是一個 4B 參數的多模態、多語言安全模型,具備自定義策略執行能力和可選的推理軌跡,適用於企業級 AI。
Endava AI 整合:使用 OpenAI Agents 重新設計軟體交付
Endava 已將 OpenAI 技術整合到其 11,000 人的員工隊伍中,以重新設計軟體交付和運營工作流程,將 AI 從生產力工具轉變為核心運營模型。
ChatGPT 做夢 記憶 更新
OpenAI 已推出一種基於 '做夢' 的更強大且計算效率更高的記憶架構,以改進 ChatGPT 如何合成、更新和回顧使用者的情境、偏好以及時間敏感資訊。
OpenAI 生物防禦在智慧時代的行動計畫
OpenAI 已啟動一項生物防禦行動計畫,透過為負責任的防禦者配備先進的 AI 能力來增強生物韌性,特別利用 GPT-Rosalind 模型。
Hugging Face hf CLI 針對代理優化的重新設計,降低了 Token 使用量並提升了成功率
Hugging Face 宣布對 hf CLI 進行了針對代理優化的重新設計,這能為 Claude Code 和 Codex 等編碼代理減少高達 6 倍的 Token 使用量,並提高成功率。
NVIDIA Nemotron 3 Ultra 支援於 vLLM
vLLM 宣布對 NVIDIA Nemotron 3 Ultra 提供 Day-0 支援,這是一個 550B 參數模型,透過混合 Transformer-Mamba MoE 架構,針對長時間運行的自主代理工作流程進行優化。
GPT-Rosalind 更新:增強生命科學能力與研究工具
摘要: OpenAI 已更新 GPT-Rosalind,整合了 GPT-5.5 的具代理能力以及在醫藥化學、基因組學和濕實驗故障排除方面的專門智能,以服務於企業規模的生命科學研究。
直接偏好優化:超越聊天機器人
提供的來源材料是來自 Hugging Face 的 429 速率限制錯誤頁面,且不包含有關 Direct Preference Optimization 的任何技術內容。
Wasmer 如何使用 Codex 建置適用於邊緣的 Node.js 執行時環境
Wasmer 使用 OpenAI 的 Codex 開發 Edge.js,這是一個能夠在 WebAssembly 沙盒中執行 Node.js 工作負載的 JavaScript 執行時環境,將開發時間從估計的一年縮短至兩週。
OpenAI 前沿 AI 民主治理藍圖
OpenAI 已發布一項藍圖,提出一個三部分的聯邦框架,供美國透過國家標準化、加強 CAISI 以及全政府韌性計畫來治理日益增強的 AI 系統。
OpenAI 公共政策議程
2026年6月3日,OpenAI 發布了其公共政策議程,概述了其使命、原則以及在安全、青少年保護、教育、勞動力轉型、深偽和 AI 基礎設施方面的政策優先事項。
Fast & Efficient LLM Inference with vLLM 課程發布
vLLM 與 DeepLearning.AI 和 Red Hat 合作,推出了一個免費的中級課程,名為 Fast & Efficient LLM Inference with vLLM,旨在教授完整的 AI 部署生命週期。
Hugging Face 速率限制阻止訪問 'Adding MCP Tools to Reachy Mini' 貼文
Hugging Face 指向博客文章 'Adding MCP Tools to Reachy Mini' 的連結返回 429 速率限制錯誤,因此無法摘要任何內容。
Holo3.1: 快速 & 本地電腦使用代理
提供的 Holo3.1 來源材料因 429 速率限制錯誤而不可用,且未提供任何技術細節。
Travelers 使用 OpenAI 部署 AI 驅動的理賠助理
Travelers 已經推出全國性的 AI 理賠助理,該助理由 OpenAI 的 Realtime API 提供動力,以自動化汽車財產損失理賠的首次損失通知,使得 85-90% 的使用者能夠自主完成理賠申報。
ChatGPT Sites: 建立內部頁面與輕量應用程式 透過 Codex
OpenAI 已推出 ChatGPT Sites,這是一項功能,允許使用者直接從 Codex 桌面應用程式建立、部署和分享內部網站與輕量互動應用程式。
Codex 適用於每個角色、工具與工作流程
OpenAI 宣布針對 Codex 推出新的角色專屬外掛、互動式網站以及就地註解,將其使用範圍擴展至開發者以外的分析師、行銷人員、銷售、投資者與銀行家。
OpenAI 青少年 AI 安全提案與全球領導力倡議
OpenAI 已提議成立一個國際青少年安全研究所,並制定了一套九點框架,以實現符合年齡的 AI 保護,這些內容將在 G7 領導人峰會上進行討論。
OpenAI Codex 擴展至知識工作
OpenAI 報告 Codex 已達到 500 萬週活躍用戶,知識工作者現在佔用戶基礎的 20%,增長速度是開發者的三倍。
vLLM Session-Aware Agentic Routing (SAAR) 發布
vLLM 推出 Session-Aware Agentic Routing (SAAR),這是一種模型選擇政策,透過在工具循環和提供者狀態過程中防止不安全的模型切換,來保持會話連續性並降低長時程 LLM 代理的成本。
vLLM-Omni 透過 AutoRound 量化加速推理
vLLM-Omni 現在整合了 Intel 的 AutoRound 訓練後量化技術,實現了 W4A16 量化,在保持準確度的同時,可減少高達 62% 的模型大小,並在 Intel XPU 和 NVIDIA GPU 上釋放性能增益。