Uber 與 OpenAI 整合:AI 驅動的司機指導與語音預訂
Uber 正整合 OpenAI 前沿模型,推出 Uber Assistant 以優化司機收入並提供語音叫車功能,降低乘客使用摩擦。
OpenAI 推出 ChatGPT Futures:2026 屆
OpenAI 已推出 ChatGPT Futures,這是一項為 2026 屆使用 AI 建構工具、推進研究並創造社會影響的學生提供資助與模型存取的計畫。
OpenAI B2B Signals: 領先企業如何拉開距離
OpenAI 推出 B2B Signals 以揭示領先企業——即使用量在第 95 個百分位的企業——現在每位員工使用的智能量是典型企業的 3.5 倍,這是由複雜的、具代理特性的工作流程驅動的。
GPT-5.5 Instant 版本說明 / 新功能概覽
OpenAI 已發布 GPT-5.5 Instant,作為 ChatGPT 的新預設模型,提升了事實準確性、減少冗長回覆,並透過更深入的使用者情境整合加強個人化。
OpenAI MRC 多路徑可靠連接協議
OpenAI 透過 Open Compute Project 發布了多路徑可靠連接(MRC)協議,以提升大型 AI 訓練叢集中的 GPU 網路韌性與效能。
GPT-5.5 Instant 系統卡
OpenAI 已發布 GPT-5.5 Instant 系統卡,標誌著 Instant 模型首次在「網路安全」與「生物與化學防護」類別被歸類為高能力。
OpenAI 歐洲青年安全藍圖與 EMEA 青年福祉補助金
OpenAI 宣布了其歐洲青年安全藍圖以及首批 EMEA 青年福祉補助金的受助者,以促進適齡 AI 使用並保護歐洲、中東與非洲的年輕人。
OpenAI 擴大 ChatGPT 廣告試點,推出自助廣告管理平台與每次點擊付費 (CPC) 出價
OpenAI 正在擴大其 ChatGPT 廣告試點,推出測試版自助廣告管理平台、每次點擊付費 (CPC) 出價以及擴充的測量工具,讓各種規模的企業都能更容易投放廣告。
OpenAI 與 PwC 在金融領域的 AI 代理人合作
OpenAI 與 PwC 正在合作部署可自動化金融工作流程的 AI 代理人,並以 OpenAI 自身的財務組織作為測試平台,以現代化 CFO 辦公室。
OpenAI 低延遲語音 AI 基礎設施
OpenAI 重新設計了其 WebRTC 架構,採用分離的中繼加收發器(relay‑plus‑transceiver)架構,以向超過 9 億每週活躍使用者提供低延遲、可擴展的語音 AI。
Google DeepMind AI 共同臨床醫師研究計畫
Google DeepMind 已推出 AI 共同臨床醫師研究計畫,這是一個多模態 AI 系統,旨在透過證據綜合和在臨床監督下的即時患者互動來支援醫療提供者。
Qwen-Scope 可解釋性工具包發布
Qwen 發布了 Qwen-Scope,一款使用稀疏自編碼器(SAE)將 Qwen3 與 Qwen3.5 模型的隱藏表示分解為可解釋特徵,以進行模型優化的可解釋性工具包。
OpenAI 高級帳戶安全發布
OpenAI 推出高級帳戶安全,這是一項可選設定,適用於 ChatGPT 與 Codex 帳戶,要求使用防釣魚驗證並停用傳統的恢復方式,以保護高風險使用者。
OpenAI 模型行為分析:'Goblin' 詞彙抽搐
OpenAI 發現,針對「Nerdy」個性功能的獎勵訊號導致 GPT-5.1 至 GPT-5.5 的模型產生了使用 goblin 與 gremlin 隱喻的非預期習慣,且此習慣進一步在其他模型行為中泛化。
IBM Granite 4.1 LLMs 發行說明 / 技術概覽
IBM 已發布 Granite 4.1,這是一系列密集型、僅解碼器的 LLMs(3B、8B 和 30B),透過嚴謹的資料策劃和多階段強化學習管線來實現高效能。
OpenAI Stargate 計算基礎設施更新
OpenAI 已超越其在美國的 10GW AI 基礎設施初始目標,並在其位於德克薩斯州阿比林的旗艦 Stargate 站點訓練了 GPT-5.5。
OpenAI 資訊時代網路安全行動計畫
OpenAI 已推出一項五大支柱的行動計畫,以民主化 AI 驅動的網路防禦,並增強對 AI 驅動威脅的韌性。
DeepInfra 與 Hugging Face 推理提供者整合
Hugging Face 已將 DeepInfra 加入為支援的推理提供者,使開發者能直接透過 Hub 和用戶端 SDK 存取超過 100 個模型(包括 DeepSeek V4 和 Kimi-K2.6)的無伺服器推理。
NVIDIA Nemotron 3 Nano Omni 發佈說明 / 新功能介紹
NVIDIA 已發佈 Nemotron 3 Nano Omni,這是一款能夠跨文字、圖像、影片和音訊進行長上下文推理的全模態模型,在文檔智能和影片理解基準測試中提供了業界領先的準確度。
FlashQLA:適用於 CP / 反向傳播的融合線性注意力核心(針對 GDN)
Qwen 已開源 FlashQLA,這是一個基於 TileLang 的高效能線性注意力核心庫,能在 NVIDIA Hopper GPU 上為門控增量網路(GDN)層提供 2‑3 倍的前向與 2 倍的反向加速。
OpenAI 社群安全與暴力緩減框架
OpenAI 已詳細說明其多層次方法,以防止將 ChatGPT 用於規劃或執行暴力,結合模型訓練、自動偵測與人工審查。
vLLM 中對 NVIDIA Nemotron 3 Nano Omni 的支援
vLLM 現已支援 NVIDIA Nemotron 3 Nano Omni,這是一款高效的 30 億參數 MoE 多模態模型,能在單一迴圈中統合視覺、音訊與語言推理,以驅動代理式 AI。
OpenAI GPT-5.5、Codex 與 AWS 上的受管代理發布說明
2026年4月28日,OpenAI 宣佈其前沿模型(包括 GPT-5.5、Codex 程式碼代理以及由 OpenAI 提供動力的 Amazon Bedrock 受管代理)現已在 AWS 上以有限預覽方式提供,讓企業能在現有的 AWS 安全、合規與採購工作流程中使用這些功能。
OpenAI 獲得 FedRAMP Moderate 授權
OpenAI 已取得 ChatGPT Enterprise 與其 API 平台的 FedRAMP 20x Moderate 授權,使美國政府機構能在符合聯邦安全與隱私標準的前提下存取包括 GPT-5.5 在內的前沿 AI 模型。
TITLE: Google DeepMind 與韓國的合作
SUMMARY: Google DeepMind 已與韓國科學與資訊通訊部合作,在首爾設立 AI 校園並部署前沿 AI 模型,以加速生命科學、能源與氣候領域的科學研究。
微軟與 OpenAI 合作的下一階段
OpenAI 與微軟已修改合作協議,以提供更大的彈性,允許 OpenAI 在任何雲端服務提供商上提供產品,同時仍將微軟作為其主要雲端合作夥伴。
# Choco 使用 AI 代理自動化食品分銷
Choco 宣布使用 OpenAI API 構建的 AI 驅動的 OrderAgent 和 VoiceAgent,以自動化食品分銷訂單處理。
Symphony: Codex 編排的開源規範
OpenAI 發布了 Symphony,這是一個開源規範,將 Linear 等問題追蹤器轉化為 Codex 編碼代理的常駐編排器,使團隊能夠自動化常規實作工作並提高 PR 吞吐量。
# OpenAI 隱私過濾器:構建可擴展的 PII 偵測網頁應用
OpenAI 已發布 Privacy Filter,一個開源的 1.5B 參數 PII 偵測器,能夠在 128k 上下文窗口內標記八種類別的敏感資料。
OpenAI 通用人工智慧 (AGI) 開發的運營原則
OpenAI 已概述五項核心原則——民主化、能力賦予、韌性、普惠繁榮與適應性——以確保通用人工智慧 (AGI) 惠及全人類。
OpenAI AI 工作過渡框架
OpenAI 已推出 AI 工作過渡框架,以分析 AI 對 921 個職業的就業影響,根據自動化風險、重組、成長潛力和穩定性將工作分為四條路徑。
DeepSeek-V4 發佈說明:為 AI Agents 提供高效的 1M-Token 上下文
DeepSeek-V4 引入了由混合 CSA/HCA 注意力機制驅動的 1M-token 上下文窗口,專為長時程代理工作負載和工具使用軌跡進行了優化。
vLLM DeepSeek V4 支援:高效長上下文注意力
vLLM 現已支援 DeepSeek V4-Pro 與 V4-Flash,實作了一種新注意力機制,使上下文長度可達一百萬個 token,並大幅節省 KV cache 記憶體。
# OpenAI GPT-5.5 系統卡
OpenAI 已發布 GPT-5.5,這是一個針對複雜現實世界任務和工具使用進行優化的模型,具備增強的任務理解能力以及更穩固的安全框架。
OpenAI GPT-5.5 版本說明
OpenAI 已發布 GPT-5.5 與 GPT-5.5 Pro,於代理式程式編寫、電腦使用與科學研究方面帶來重大進步,同時保持 GPT-5.4 的延遲表現。
如何使用 ChatGPT Work 處理日常任務
OpenAI 在 2026 年 4 月 23 日的 Academy 貼文說明 ChatGPT Work 如何將現有的工作材料——如行事曆、電子郵件、文件和試算表——轉變為團隊可以審閱和編輯的初稿簡報、摘要、投影片、工作簿、計畫和流程文件。
在 Chrome 擴充功能中使用 Transformers.js
Hugging Face 提供了一份技術指南,說明如何在使用 Manifest V3 的 Chrome 擴充功能中整合 Transformers.js,該架構以背景託管的模型為基礎,並由 Gemma 4 E2B 提供動力。
ChatGPT 臨床醫師版發布
OpenAI 已推出 ChatGPT 臨床醫師版,這是針對已驗證的美國醫療提供者的免費版 ChatGPT,旨在自動化文件撰寫、醫學研究與臨床工作流程。
# Google DeepMind 解耦 DiLoCo
Google DeepMind 推出了解耦 DiLoCo,一種分散式訓練架構,能夠在低頻寬且使用混合硬體世代的情況下,實現跨遙遠資料中心的彈性、非同步 LLM 訓練。
在 ChatGPT 中介紹工作區代理 – OpenAI 研究預覽
OpenAI 在 ChatGPT 中推出工作區代理,使團隊能夠建立共享的、cloud‑run AI 代理,在遵守組織控管的前提下,自動化跨工具的多步驟工作流程。
ChatGPT 中的工作區代理:概述與建置方法
OpenAI 在 ChatGPT 中推出工作區代理,透過結合觸發器、流程與工具整合,自動化可重複、結構化的工作流程,讓團隊能共享一致的 AI 驅動任務。
OpenAI Responses API WebSocket 模式發布
OpenAI 為 Responses API 引入了 WebSocket 支援,透過消除冗餘的 API 開銷,將代理式工作流程的延遲降低最高 40%,並實現每秒高達 4,000 個 token 的推論速度。
Qwen3.6-27B 版本說明 / 新功能
Qwen 已發布 Qwen3.6-27B,一款密集的 270 億參數多模態模型,在所有主要代理式編程基準測試上超越了更大的 Qwen3.5-397B-A17B。
vLLM FP8 KV-Cache 與 Attention 量化更新
vLLM 已優化 FP8 KV-cache 與 attention 量化,在 Hopper 與 Blackwell 架構上降低了解碼延遲與記憶體使用量,同時保持接近基準的準確度。
OpenAI 隱私過濾器發布
OpenAI 已發布隱私過濾器,這是一個開放權重、1.5B 參數的模型,設計用於在非結構化文字中以高吞吐量、情境感知的方式偵測與刪除個人可識別資訊(PII)。
Google DeepMind 與 Accenture、Bain & Company、BCG、Deloitte 以及 McKinsey 合作,加速 AI 轉型
Google DeepMind 宣佈與 Accenture、Bain & Company、BCG、Deloitte 以及 McKinsey 建立合作夥伴關係,透過提供 Gemini 等前沿模型的早期存取、共同開發產業特定 AI 解決方案,並將領導層與客戶的執行長連結,以加速企業 AI 轉型。
ChatGPT Images 2.0 版本發布
OpenAI 已發布 ChatGPT Images 2.0,這是一項顯著的影像生成能力更新,具備提升的精確度、多語言文字渲染以及加強的風格寫實性。
QIMMA:以品質為先的阿拉伯語大型語言模型排行榜
Hugging Face 與合作夥伴推出了 QIMMA,這是一個全新的阿拉伯語大型語言模型排行榜,採用了嚴格的品質驗證流程,以確保基準測試能真實反映語言能力。
將 Codex 擴展至全球企業 – OpenAI 公告
OpenAI 公告指出,Codex 使用量從每週超過 3 million 開發者增長至超過 4 million 開發者,並推出 Codex Labs 以及全球系統整合商夥伴計畫,以協助企業在軟體開發生命週期及其以外的領域採用 Codex。
vLLM v0.20.0 為混合 SSM 模型新增分散式服務
vLLM v0.20.0 為混合 SSM-FA 模型引入分散式 prefill/decode 服務,透過雙描述子視圖與三描述子卷積狀態傳輸,實現高效的 KV 傳輸。