封存 · 11 個實驗室 · 3,049 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

1001

Qwen3-Max-Thinking 發布說明

Qwen 已發布 Qwen3-Max-Thinking,這是一款旗艦推理模型,具備自適應工具使用與多輪測試時縮放策略,以與 GPT-5.2-Thinking 與 Claude-Opus-4.5 競爭。

1002

OpenAI Codex CLI 代理循環技術概述

OpenAI 說明了 Codex CLI 的代理循環架構,詳細闡述其如何透過提示快取與壓縮來管理模型推論、提示建構與上下文視窗的最佳化。

1003

Ollama launch command 發布

Ollama 在 0.15+ 版本中推出了 'ollama launch' 指令,讓使用者無需手動設定環境變數或設定檔,即可設定並運行 Claude Code 和 OpenCode 等開發工具。

1004

將 PostgreSQL 擴展以支援 8 億 ChatGPT 用戶

OpenAI 透過使用單主節點架構、近 50 個讀取副本以及積極的工作負載優化,將 PostgreSQL 擴展至支援 8 億用戶與每秒數百萬次查詢。

1005

ChatGPT 企業採用模式與 GPT-5 整合

OpenAI 報告稱,ChatGPT 正在各行業自下而上地被採用,GPT-5 引入即時路由器,以自動化企業工作流程中先進功能的使用。

1006

Praktika AI 語言學習架構

Praktika 使用由 GPT-5.2 與 GPT-5 Pro 驅動的多代理系統,透過即時對話式 AI 提供個人化、適應性的語言教學。

1007

Anthropic Claude 2026 年憲法發布

Anthropic 發布了其 Claude 模型的新版公開授權憲法,詳細說明了指導 Claude 行為的價值觀、安全優先順序與訓練角色。

1008

Qwen3-TTS 版本說明:開源語音設計、克隆與生成

Qwen 已開源 Qwen3-TTS 系列,提供 0.6B 與 1.7B 兩種規模的模型,支援高保真語音克隆、以自然語言進行語音設計,以及跨 10 種語言的超低延遲串流語音生成。

1009

Debugging a Memory Leak in vLLM

Mistral AI 解決了 vLLM 在進行解耦式服務時,由 UCX 的 mmap 鉤子機制所引起的系統記憶體洩漏問題,並透過禁用鉤子或限制註冊快取來修復該問題。

1010

Higgsfield AI 影片平台與 OpenAI 模型的整合

Higgsfield 是一個生成式媒體平台,利用 GPT-4.1、GPT-5 與 Sora 2,將產品連結和簡單想法轉化為具電影感、以社群為先的短影片。

1011

AssetOpsBench:彌合 AI 代理基準與工業現實之間的差距

Hugging Face 與 IBM Research 推出 AssetOpsBench,一個旨在評估工業資產生命週期管理中多代理 AI 系統的綜合基準,聚焦於安全關鍵的失效模式與運營限制。

1012

OpenAI 終結能力過剩報告與倡議

OpenAI 已發布關於 AI 能力過剩的研究,並擴大其 OpenAI for Countries 計畫,協助各國政府將 AI 融入教育、健康與公共服務,以防止經濟分化。

1013

OpenAI Education for Countries 計畫啟動

OpenAI 推出 Education for Countries 計畫,該計畫與政府與大學合作,將 ChatGPT Edu、GPT‑5.2 等 AI 工具嵌入 K‑12 與高等教育系統,旨在縮小能力過剩(capability overhang)並為學生在 AI 驅動的職場做好準備。

1014

設計抗 AI 技術評估

Anthropic 詳細說明了其效能工程帶回家測試如何透過三次迭代演進,以在 Claude 模型日益超越人類候選人的情況下,維持評估信號。

1015

Anthropic 與 Teach For All AI 培訓計畫

Anthropic 與 Teach For All 合作啟動了 AI 素養與創作者集體 (LCC),為遍布 63 個國家的超過 100,000 名教育工作者提供 AI 素養培訓與 Claude 存取權限。

1016

OpenAI Horizon 1000:推動 AI 在基層醫療的發展

OpenAI 與蓋茨基金會已啟動 Horizon 1000,這是一項 5,000 萬美元的計畫,旨在於 2028 年前將 AI 能力整合至非洲各國的 1,000 家基層醫療診所,起始於盧旺達。

1017

OpenAI Stargate 社群計畫公告

OpenAI 宣布了其 Stargate 社群計畫,承諾自行資助能源、減少用水,並在擴展 AI 基礎設施以達成 2029 年 10 GW 目標的同時創造在地工作機會。

1018

Anthropic 任命 Mariano-Florentino Cuéllar 加入長期利益信託

Anthropic 宣布 Mariano-Florentino (Tino) Cuéllar 加入其長期利益信託,在 AI 重塑全球治理的背景下,為公司帶來法律與國際事務專業知識,以引導其公益使命。

1019

DeepSeek時刻一年後:中國開源AI生態系統的崛起

Hugging Face 分析 DeepSeek R1 的發布如何催化中國向開源 AI 的巨大轉變,導致高性能開源模型激增,現在主導全球下載指標。

1020

ServiceNow 與 OpenAI 合作推動可執行的企業 AI

ServiceNow 與 OpenAI 合作,將 GPT-5.2 及多模態功能整合至其 AI 平台,使企業能在 IT、財務與人力資源領域自動化複雜工作流程。

1021

Differential Transformer V2 原始資料無法取得

由於 Hugging Face 網站出現 429 Too Many Requests 錯誤,導致 Differential Transformer V2 的原始內容無法取得。

1022

OpenAI 針對 ChatGPT 的年齡預測

OpenAI 正在於 ChatGPT 消費者方案上部署年齡預測模型,以自動為可能未滿 18 歲的使用者套用青少年安全防護措施。

1023

Waypoint-1: 即時互動視頻擴散模型來自 Overworld

Overworld 已發布 Waypoint-1,這是一個在 10,000 小時遊戲畫面上訓練的即時互動視頻擴散模型,可透過文字、滑鼠和鍵盤實現零延遲世界互動。

1024

Ollama 新增 Z-Image Turbo 與 FLUX.2 Klein 實驗性圖像生成功能

Ollama 宣布在 macOS 上推出實驗性圖像生成功能,使用 6B 參數的 Z-Image Turbo 模型與 Black Forest Labs 的 FLUX.2 Klein 模型,這標誌著 Ollama 生態系中首次具備原生文字轉圖像能力。

1025

Anthropic Assistant Axis 研究

Anthropic 提出「Assistant Axis」——一個識別並穩定大型語言模型中「助理」人格的神經激活方向,並證實沿此軸線進行激活值截斷,可在不損及模型能力的前提下,有效降低有害人格偏移的風險。

1026

OpenAI 商業模式與運算規模策略

OpenAI 已實施一種隨智慧價值而擴展的商業模式,透過多元化的運算組合與多層次貨幣化,從 2023 年到 2025 年實現了十倍的營收增長。

1027

D4RT:動態 4D 重建與追蹤

Google DeepMind 推出 D4RT,一個統一的 AI 模型,用於 4D 場景重建與追蹤,其效率比以往方法提升最高可達 300 倍。

1028

ChatGPT Go 全球發布

OpenAI 已將 ChatGPT Go(一個每月 8 美元的低成本訂閱方案,僅在美國提供)擴展至所有可用市場,以提升對 GPT-5.2 Instant 的全球存取。

1029

OpenAI 廣告策略與 ChatGPT Go 擴展

OpenAI 正將每月 8 美元的 ChatGPT Go 訂閱層級擴展至美國及所有可用市場,並將在免費與 Go 層級開始測試廣告,以提升 AI 的可及性。

1030

Anthropic Claude Sonnet 4.5 展示僅使用開源工具的自主多階段攻擊

Anthropic 宣布 Claude Sonnet 4.5 可自主執行真實網路訓練環境中的多階段攻擊——包括完整的 Equifax 式資料竊取——僅使用 Kali Linux 上的標準 Bash 命令,突顯 AI 驅動網路作戰的門檻正迅速降低。

1031

Anthropic 任命 Irina Ghose 為印度區總經理

Anthropic 已任命 Irina Ghose 為印度區總經理,負責領導公司的擴張以及在 Bengaluru 開設首個辦公室。

1032

Ollama v0.14.0: Anthropic API 相容性與 Claude Code 支援

Ollama v0.14.0 引入了對 Anthropic Messages API 的相容性,使得 Claude Code 與其他 Anthropic SDK 應用程式能夠使用本地與雲端開源模型。

1033

OpenAI 對 Merge Labs 的投資

OpenAI 正參與 Merge Labs 的種子輪投資,該研究實驗室致力於開發高頻寬腦機介面(BCI),以橋接生物與人工智慧。

1034

OpenAI 倡議以國內製造強化美國 AI 供應鏈

OpenAI 已發布一項提案請求(RFP),以識別並促進關鍵 AI 基礎設施元件的美國本土製造,包括資料中心硬體、消費電子和機器人。

1035

Hugging Face 開放回應推論標準

Hugging Face 推出了 Open Responses,一項基於 Responses API 的開放推論標準,旨在取代 Chat Completion 格式,以支援代理式 AI 工作流程。

1036

Anthropic 經濟指數 2026 年 1 月報告 – 經濟基本要素

Anthropic 的 2026 年 1 月經濟指數報告引入五項新的「經濟基本要素」,用以量化 Claude 的使用方式,揭示了地理集中化、任務複雜度、技能偏誤與生產力影響等現象。

1037

Anthropic 經濟指數 2026 年 1 月報告

Anthropic 引入經濟基礎指標以衡量 AI 對勞動生產力的影響,發現 Claude 對需要高等教育的複雜任務提供最大的加速效果。

1038

OpenAI Codex 與 Ollama 集成

Ollama 現在允許 OpenAI Codex CLI 使用開源權重模型,實現了使用 gpt-oss:20b 和 gpt-oss:120b 等模型進行本地代碼執行和修改的功能。

1039

Anthropic Claude for Life Sciences 透過新工具與合作夥伴關係加速研究

Anthropic 宣布,由 Opus 4.5 模型驅動的 Claude for Life Sciences 正被應用於 Biomni、MozzareLLM 和 Lundberg Lab 的假設生成器等系統中,大幅提升了數據分析、實驗設計和基因目標選擇的速度,標誌著向 AI 驅動科學發現的轉型。

1040

OpenAI 與 Cerebras 低延遲推論合作夥伴關係

OpenAI 正與 Cerebras 合作,將專為 AI 設計的系統整合到其推論堆疊中,以加速 AI 模型回應並實現即時 AI 互動。

1041

使用 Claude 與屬性測試尋找 Bug

Anthropic 研究人員使用 Claude 開發了一款 AI agent,透過推論程式碼屬性並使用 Hypothesis 進行屬性測試,自主地在大型軟體專案中識別 Bug。

1042

Veo 3.1 發行說明:增強的 Ingredients to Video 與 4K 升級

Google DeepMind 已發布 Veo 3.1,推出改進的身分與物件一致性以支援影像轉影片生成、原生直向影片支援,以及升級至 1080p 與 4K 解析度。

1043

Zenken 案例研究:利用 ChatGPT Enterprise 擴展銷售與營運

Zenken 已整合 ChatGPT Enterprise 以自動化知識工作,實現了每年 5,000 萬日元的外包成本節省,且最終提案批准率提升了 30%。

1044

Anthropic Labs: 孵化實驗性 AI 產品

Anthropic 已擴展 Labs,這是一個專門致力於在 Claude 能力前沿孵化實驗性產品的團隊,旨在加速從研究預覽版到規模化產品的轉型。

1045

Anthropic 發布 Claude for Healthcare,並透過新連接器與 Agent Skills 扩展 Claude for Life Sciences

Anthropic 宣布推出 Claude for Healthcare —— 為醫療提供者、保險公司與健康科技公司設計的符合 HIPAA 標準工具,並為 Claude for Life Sciences 新增數十項科學連接器與 Agent Skills,皆由 Opus 4.5 模型驅動。

1046

以資訊驅動的影像系統設計

BAIR 的研究人員開發了一個框架,利用互資訊來評估與優化影像系統,使得在不需要特定任務解碼器的情況下即可設計高效能硬體。

1047

OpenAI 與軟銀集團與 SB Energy 的合作夥伴關係

OpenAI 與軟銀集團各自投資 5 億美元於 SB Energy,以加速 AI 數據中心園區與能源基礎設施的開發,包括德克薩斯州米拉姆縣的 1.2 GW 站點。

1048

Datadog 整合 OpenAI Codex 以進行系統層級程式碼審查

Datadog 已將 OpenAI Codex 部署給超過 1,000 名工程師,用於在程式碼審查中識別系統性風險與跨服務相依性,成功偵測出 22% 的歷史事故,這些事故是人工審查者未發現的。

1049

Anthropic Constitutional Classifiers++ 發佈

Anthropic 推出了 Constitutional Classifiers++,這是一種兩階段集成防禦系統,將運算開銷降低至約 1%,同時消除了已知的通用越獄攻擊。

1050

Anthropic:解密 AI 代理的評估方法

Anthropic 提供了一套全面的框架,用於設計與實作 AI 代理的自動化評估,以從反應式調試轉向系統性、以指標為導向的開發流程。