✷ 封存 · 11 個實驗室 · 3,049 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
如何使用 ChatGPT Work 處理日常任務
OpenAI 在 2026 年 4 月 23 日的 Academy 貼文說明 ChatGPT Work 如何將現有的工作材料——如行事曆、電子郵件、文件和試算表——轉變為團隊可以審閱和編輯的初稿簡報、摘要、投影片、工作簿、計畫和流程文件。
在 Chrome 擴充功能中使用 Transformers.js
Hugging Face 提供了一份技術指南,說明如何在使用 Manifest V3 的 Chrome 擴充功能中整合 Transformers.js,該架構以背景託管的模型為基礎,並由 Gemma 4 E2B 提供動力。
xAI Grok Voice Think Fast 1.0 發佈
xAI 已發佈 grok-voice-think-fast-1.0,這是一款專為複雜企業工作流程、高容量工具呼叫和低延遲即時推理而設計的旗艦級語音模型。
Anthropic Claude Code 品質事後檢討
Anthropic 已解決了影響 Claude Code、Claude Agent SDK 和 Claude Cowork 的三個獨立技術問題,恢復了預設的高推理強度,並修復了會話記憶錯誤。
ChatGPT 臨床醫師版發布
OpenAI 已推出 ChatGPT 臨床醫師版,這是針對已驗證的美國醫療提供者的免費版 ChatGPT,旨在自動化文件撰寫、醫學研究與臨床工作流程。
# Google DeepMind 解耦 DiLoCo
Google DeepMind 推出了解耦 DiLoCo,一種分散式訓練架構,能夠在低頻寬且使用混合硬體世代的情況下,實現跨遙遠資料中心的彈性、非同步 LLM 訓練。
在 ChatGPT 中介紹工作區代理 – OpenAI 研究預覽
OpenAI 在 ChatGPT 中推出工作區代理,使團隊能夠建立共享的、cloud‑run AI 代理,在遵守組織控管的前提下,自動化跨工具的多步驟工作流程。
ChatGPT 中的工作區代理:概述與建置方法
OpenAI 在 ChatGPT 中推出工作區代理,透過結合觸發器、流程與工具整合,自動化可重複、結構化的工作流程,讓團隊能共享一致的 AI 驅動任務。
OpenAI Responses API WebSocket 模式發布
OpenAI 為 Responses API 引入了 WebSocket 支援,透過消除冗餘的 API 開銷,將代理式工作流程的延遲降低最高 40%,並實現每秒高達 4,000 個 token 的推論速度。
Qwen3.6-27B 版本說明 / 新功能
Qwen 已發布 Qwen3.6-27B,一款密集的 270 億參數多模態模型,在所有主要代理式編程基準測試上超越了更大的 Qwen3.5-397B-A17B。
OpenAI 隱私過濾器發布
OpenAI 已發布隱私過濾器,這是一個開放權重、1.5B 參數的模型,設計用於在非結構化文字中以高吞吐量、情境感知的方式偵測與刪除個人可識別資訊(PII)。
vLLM FP8 KV-Cache 與 Attention 量化更新
vLLM 已優化 FP8 KV-cache 與 attention 量化,在 Hopper 與 Blackwell 架構上降低了解碼延遲與記憶體使用量,同時保持接近基準的準確度。
Anthropic 研究:基於 81,000 名用戶調查的 AI 經濟學
Anthropic 對 81,000 名 Claude 用戶的調查顯示,失業風險擔憂在職涯早期工作者和 AI 接觸程度高的職位中最高,而生產力增益對高薪工作者和擴展專業範圍的人來說最為顯著。
Anthropic 經濟指數調查公告
Anthropic 推出了經濟指數調查(Economic Index Survey),這是一項每月進行的定性研究,使用 Anthropic Interviewer 即時追蹤 AI 如何影響工作、生產力和工作者的預期。
Google DeepMind 與 Accenture、Bain & Company、BCG、Deloitte 以及 McKinsey 合作,加速 AI 轉型
Google DeepMind 宣佈與 Accenture、Bain & Company、BCG、Deloitte 以及 McKinsey 建立合作夥伴關係,透過提供 Gemini 等前沿模型的早期存取、共同開發產業特定 AI 解決方案,並將領導層與客戶的執行長連結,以加速企業 AI 轉型。
ChatGPT Images 2.0 版本發布
OpenAI 已發布 ChatGPT Images 2.0,這是一項顯著的影像生成能力更新,具備提升的精確度、多語言文字渲染以及加強的風格寫實性。
QIMMA:以品質為先的阿拉伯語大型語言模型排行榜
Hugging Face 與合作夥伴推出了 QIMMA,這是一個全新的阿拉伯語大型語言模型排行榜,採用了嚴格的品質驗證流程,以確保基準測試能真實反映語言能力。
vLLM v0.20.0 為混合 SSM 模型新增分散式服務
vLLM v0.20.0 為混合 SSM-FA 模型引入分散式 prefill/decode 服務,透過雙描述子視圖與三描述子卷積狀態傳輸,實現高效的 KV 傳輸。
Hugging Face:AI 與網路安全的未來
Hugging Face 主張,開源 AI 模型與工具對於網路安全防禦至關重要,以對抗像 Mythos 這類自主漏洞發現系統所帶來的風險。
將 Codex 擴展至全球企業 – OpenAI 公告
OpenAI 公告指出,Codex 使用量從每週超過 3 million 開發者增長至超過 4 million 開發者,並推出 Codex Labs 以及全球系統整合商夥伴計畫,以協助企業在軟體開發生命週期及其以外的領域採用 Codex。
GRASP:針對較長視野的世界模型之梯度規劃
BAIR 介紹了 GRASP,一種梯度式規劃器,透過將軌跡提升至虛擬狀態並將梯度僅限於動作,以避免對狀態輸入的對抗性敏感性,從而在學習的世界模型中實現穩健的長視野規劃。
Hyatt 部署 ChatGPT Enterprise 以提升全球營運
Hyatt 已整合 ChatGPT Enterprise,為其全球企業與酒店員工提供 GPT 5.4 和 Codex 的存取,以自動化手動任務並改善賓客體驗。
Anthropic 與 Amazon 擴大合作以獲取 5GW 的運算能力
Anthropic 與 Amazon 已簽署協議,以確保獲得高達 5 吉瓦的運算能力,並在十年內向 AWS 技術投入 1,000 億美元,以擴大 Claude 的訓練與部署規模。
Qwen3.6-Max-Preview 版本說明 / 新功能
Qwen3.6-Max-Preview 是 Qwen 推出的專有預覽模型,在代理式程式編寫、世界知識與指令遵循方面較 Qwen3.6-Plus 有所提升。
xAI Grok Speech to Text and Text to Speech APIs
xAI 已發布了獨立的 Grok Speech to Text (STT) 與 Text to Speech (TTS) API,基於驅動 Grok Voice 與 Tesla 車輛的技術,提供高準確度的轉錄與具表現力的語音生成功能。
OpenAI Codex 更新 2026 年 4 月
OpenAI 已更新 Codex,支援背景電腦使用、長期任務自動化與記憶功能,將其從程式碼產生器擴展為完整的軟體開發生命週期夥伴。
GPT-Rosalind: OpenAI 的生命科學前沿推理模型
OpenAI 已推出 GPT-Rosalind,一個針對生物學、藥物發現與轉譯醫學優化的推理模型,以加速早期研究工作流程。
Hugging Face transformers-to-mlx Skill and Test Harness
Hugging Face 發布了一項 Skill 與一個非 Agent 式的測試工具 (non-agentic test harness),旨在簡化從 transformers 函式庫到 mlx-lm 的語言模型移植流程,同時保持高代碼品質與審核信號。
使用 Sentence Transformers 訓練與微調多模態嵌入與重新排序模型
Hugging Face 發布了一篇關於使用 Sentence Transformers 訓練與微調多模態嵌入與重新排序模型的指南,展示了針對特定任務的微調如何提升檢索任務(如視覺文件檢索)的效能。
OpenAI Trusted Access for Cyber 計畫
OpenAI 推出了 Trusted Access for Cyber 計畫,透過為多樣化的防禦者生態系統提供分級的先進網路能力訪問權限以及 1,000 萬美元的 API credits,以增強全球數位韌性。
Ecom-RLVE: 電子商務對話代理的適應性可驗證環境
Hugging Face 推出 EcomRLVE-GYM,一個使用八個可驗證的多輪環境並具備適應性難度調整的框架,用於訓練電子商務代理,以彌合對話流暢性與實際任務完成之間的差距。
Gemini 3.1 Flash TTS 發佈說明 / 新功能
Google DeepMind 已發佈 Gemini 3.1 Flash TTS,這是一款具備自然語言音訊標籤的文字轉語音模型,可針對 70 多種語言的語音風格、節奏和表達方式進行精確控制。
VAKRA 基準測試分析:代理推理、工具使用與失效模式
Hugging Face 發布了 VAKRA 基準測試,這是一個以工具為基礎的可執行套件,用於評估 AI 代理在 8,000 多個 API 和文件來源上的組合推理能力,揭示了在工具選擇、多跳推理和策略遵循方面的普遍失敗問題。
OpenAI 代理 SDK 更新
OpenAI 已發布 Agents SDK 的更新功能,引入模型原生的 harness 與原生沙盒執行,以提升代理在生產環境中的可靠性與效能。
HCompany HoloTab 發布
HCompany 已發布 HoloTab,一款由 Holo3 模型驅動的 Chrome 擴充功能,允許使用者透過自然語言描述或錄製的例行工作來自動化網頁任務。
Qwen3.6-35B-A3B 發布說明
Qwen 已發布 Qwen3.6-35B-A3B,這是一個開源的混合專家模型,擁有 350 億總參數與 30 億活躍參數,在代理式編碼與多模態推理方面可與更大型的密集模型相抗衡。
OpenAI 擴大 Trusted Access for Cyber 計畫並發布 GPT‑5.4‑Cyber 用於防禦性網路安全
OpenAI 將其 Trusted Access for Cyber 計畫擴展至數千名已驗證的防禦者,並發布 GPT‑5.4‑Cyber,一個經過微調、更加寬容的模型,專為防禦性網路安全工作而設計。
vLLM Korea Meetup 2026 總結
vLLM Korea Meetup 2026 在首爾凸顯 vLLM 發展為統一的推理基礎設施,展示社區成長、硬體整合進展、生產堆疊功能,以及跨開源與企業軌道的真實部署策略。
Anthropic 自動化對齊研究員實現 0.97 的效能差距恢復
Anthropic 的自動化對齊研究員(AARs)利用 Claude Opus 4.6,恢復了 97% 的弱模型到強模型監督的效能差距,證明大型語言模型能自主大規模生成與測試對齊想法。
Anthropic 長期利益信託任命 Vas Narasimhan 為董事會成員
Anthropic 的長期利益信託已任命 Novartis 的 CEO Vas Narasimhan 加入其董事會,以強化公司在醫療保健與生命科學 AI 應用方面的治理能力。
Gemini Robotics-ER 1.6 版本說明 / 新功能
Google DeepMind 已發布 Gemini Robotics-ER 1.6,一款以推理為先的模型,提升了空間推理、多視角理解以及儀表讀取能力,以支援自主機器人任務。
Cloudflare Agent Cloud 與 OpenAI 整合
Cloudflare Agent Cloud 現在整合了 OpenAI 前沿模型,包括 GPT-5.4 和 Codex,使企業能夠在邊緣部署可擴展、生產就緒的 AI 代理。
ChatGPT 適用於客戶成功團隊
OpenAI 已推出一份指南,供客戶成功團隊使用 ChatGPT 透過將零散的客戶情境合成為結構化的行動計畫與溝通內容,以降低運營開銷。
OpenAI 的 AI 應用
OpenAI 透過類似 ChatGPT 和 Codex 的直接存取產品提供 AI 能力,同時也透過 OpenAI API 提供可組合的建置塊,供開發者進行整合。
ChatGPT 研究指南
OpenAI 發布了一份關於使用 ChatGPT 加速研究流程的指南,介紹了兩種不同的方法:用於快速定位的搜尋(Search)以及用於多步驟調查的深度研究(Deep Research)。
OpenAI 對 Axios 開發者工具妥協的回應
OpenAI 正在輪換其 macOS 程式碼簽署憑證,因為對 Axios 函式庫的第三方供應鏈攻擊暴露了 GitHub Actions 工作流程,儘管未發現使用者資料被盜或軟體受損的證據。
OpenAI Academy:ChatGPT 為銷售團隊
OpenAI 發布了一份指南,協助銷售團隊使用 ChatGPT 加速帳戶研究、客製化外聯以及協調內部交易管理。
使用 ChatGPT 分析資料 – OpenAI Academy
OpenAI Academy 發布了一份指南,示範如何在聊天介面以及 Excel 或 Google Sheets 中直接使用 ChatGPT 進行資料分析,概述上傳資料、提出問題、生成視覺化以及確保結果可信的步驟。
OpenAI 醫療保健提示範本
OpenAI 發布了一個醫療保健頁面,提供填空式提示範本,用於臨床任務,如選擇診斷檢查、生成鑑別診斷、制定評估與計畫、記錄就診、對患者進行諮詢、協調護理交接、彙總指南以及檢索臨床參考資料。
ChatGPT 適用於運營團隊
OpenAI 已推出一份指南,讓運營團隊使用 ChatGPT 作為『隨時待命的幕僚長』,以減少協調摩擦並標準化運營工作流程。