✷ 封存 · 11 個實驗室 · 3,049 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
Claude Opus 4.6:LLM 發現的零日漏洞
Anthropic 的 Claude Opus 4.6 能夠透過類似人類研究員的推理方式,在經過充分測試的開源程式碼庫中識別高嚴重性零日漏洞。
量化代理程式碼評估中的基礎設施雜訊
Anthropic 的研究顯示,基礎設施資源配置可能在代理程式碼基準測試中導致最高達 6 個百分點的分數變異,可能掩蓋或模擬真實的模型能力差異。
使用平行 Claude Agent 團隊構建 C 編譯器
Anthropic 研究員 Nicholas Carlini 使用 16 個平行的 Claude Opus 4.6 Agent,自主地構建了一個 10 萬行基於 Rust 的 C 編譯器,該編譯器能夠編譯 Linux 6.9 kernel。
Mistral AI Voxtral Transcribe 2 發佈
Mistral AI 已發佈 Voxtral Transcribe 2,包含用於高效批次處理的 Voxtral Mini Transcribe V2,以及用於超低延遲即時轉錄的 Voxtral Realtime。
OpenAI Codex 應用伺服器架構與整合
OpenAI 推出了 Codex 應用伺服器,一種基於 JSON-RPC 的協議與流程,將 Codex 代理程式框架公開給各種客戶端,使 IDE、網頁執行環境與終端介面皆能獲得一致的代理體驗。
Hugging Face 社群評估
Hugging Face 推出了社群評估,一個去中心化的系統,用於在 Hub 上直接報告與彙總模型基準分數,以提升透明度與可重現性。
Anthropic 承諾為 Claude 提供無廣告體驗
Anthropic 已宣布 Claude 將保持無廣告,以確保 AI 助手完全符合使用者的利益,並為深度思考與工作維持一個專注的環境。
H Company Holo2-235B-A22B 預覽版發布
H Company 已發布 Holo2-235B-A22B 預覽版,這是一款在 Screenspot-Pro 與 OSWorld G 基準測試上達到 state-of-the-art 表現的使用者介面本地化模型。
全球開源 AI 生態系統的未來:從 DeepSeek 到 AI+
Hugging Face 分析了開源如何成為中國 AI 組織的主導策略,從孤立的模型突破轉向模型、硬體與基礎設施的可擴展、整合生態系統。
文本到圖像模型的訓練設計:消融實驗的教訓
由於 429 Too Many Requests 錯誤,提供的 Hugging Face 文章關於文本到圖像模型訓練設計的來源資料無法取得。
OpenAI Sora 動態哲學
OpenAI 詳細說明了 Sora 動態的設計原則與安全框架,重點在於以創意為導向的排序、個人化推薦以及多層次的安全防護。
Apple Xcode 26.3 Claude Agent SDK 整合
Apple Xcode 26.3 整合了 Claude Agent SDK,實現了自主編碼任務、透過 Xcode Previews 進行視覺驗證,以及在 IDE 內進行跨專案的推理。
Qwen3-Coder-Next 釋出:高效能代理式編碼模型
Qwen3-Coder-Next 是一個基於混合注意力與 MoE 架構的開放權重模型,在 SWE-Bench Verified 上達到超過 70% 的成功率,提供與規模大 10‑20 倍模型相當的效能。
Snowflake 與 OpenAI 合作推動企業智能
OpenAI 與 Snowflake 已達成一項價值 2 億美元的協議,旨在將 OpenAI 前沿模型(包括 GPT-5.2)直接整合至 Snowflake AI Data Cloud 中,以實現安全且基於數據的 AI agent 與應用程式的創建。
OpenAI Codex 應用程式發布 – 多代理桌面介面(適用於 macOS 與 Windows)
OpenAI 推出適用於 macOS 的 Codex 桌面應用程式(Windows 支援於 2026 年 3 月加入),提供一個統一介面,讓開發者能平行執行、監督並協作多個 AI 代理,透過可重複使用的技能擴充功能,並自動化重複性任務。
xAI 被 SpaceX 收購
SpaceX 已收購 xAI,如 2026 年 2 月 2 日所宣布,將該 AI 實驗室整合至該航太公司中。
Anthropic 與 Allen Institute 及 HHMI 合作進行科學發現
Anthropic 已與 Allen Institute 和 Howard Hughes Medical Institute (HHMI) 合作,透過專用的 AI 代理和多代理系統,將 Claude 整合到前沿生物研究中。
Ollama 發布 OpenClaw 個人 AI 編碼助手
Ollama 發布了 OpenClaw,這是一款在本地運行的個人 AI 助手,透過一個中央閘道器將 WhatsApp、Telegram、Slack、Discord、iMessage 和其他通訊平台連接到 AI 編碼代理,實現了私密且跨平台的程式碼協助。
行動代號「滾石行動」(Trolling Stone):與俄羅斯相關的影響力活動
OpenAI 披露其封禁了多個用於協調俄羅斯相關影響力行動的 ChatGPT 帳號,這些帳號生成了關於阿根廷一位俄羅斯邪教領袖的假新聞和評論,凸顯了 AI 被濫用於虛假民意造勢的問題。
OpenAI 關於 AI 驅動浪漫詐騙的案例研究
OpenAI 識別出一個三階段工作流程——試探、誘發與收網——惡意行為者利用此流程透過 ChatGPT 進行浪漫與投資詐騙。
OpenAI Silver Lining Playbook:針對美國人士的中國來源活動
OpenAI 揭露了一項與中國有關的行動,該行動利用 ChatGPT 起草針對美國官員的社交工程電子郵件,凸顯了生成式 AI 如何被武器化以進行外國情報招募。
Operation False Witness:OpenAI 瓦解 AI 驅動的詐騙追回行動
OpenAI 封禁了一組 ChatGPT 帳戶,這些帳戶被一個位於柬埔寨的犯罪組織用於冒充律師事務所和美國當局,進行詐騙追回計畫。
「約會誘餌」行動:OpenAI 瓦解 AI 驅動的浪漫詐騙網絡
OpenAI 封鎖了一批涉及半自動化浪漫與任務詐騙的 ChatGPT 帳號及一名 API 客戶。該詐騙網絡可能源自柬埔寨,每月針對數百名受害者進行詐騙。
OpenAI 行動代號「魚飼料」:俄羅斯內容農場遭瓦解
OpenAI 封禁了一組與俄羅斯「Rybar」行動相關的 ChatGPT 帳號,該網絡利用 AI 生成的文字與影片來推動社交媒體上的隱蔽影響力活動,凸顯了大型語言模型被濫用於散布假訊息的問題。
OpenAI Operation No Bell 案例研究
OpenAI 封禁了一個與俄羅斯有關的 ChatGPT 帳號,該帳號被用於 Operation No Bell,旨在生成針對撒哈拉以南非洲和美國的地緣政治假訊息。
OpenAI 案例研究:中國執法部門的「網路特戰」影響力行動
OpenAI 披露其封禁了一個與中國執法部門有關的 ChatGPT 帳號,該帳號曾試圖策劃並報告針對日本首相和異議人士的隱蔽影響力行動,揭露了一項大規模、由 AI 增強的「網路特戰」行動。
Project Genie:Google DeepMind 的互動世界模型原型
Google DeepMind 推出了 Project Genie,這是一個由 Genie 3 驅動的實驗性研究原型,使用戶能夠創建、探索與重新混搭互動式即時生成的環境。
OpenAI 內部資料代理的內幕
OpenAI 開發了一個專屬的內部 AI 資料代理,使員工能夠透過自然語言在 600 PB 的資料上執行複雜的資料分析,並利用多層次的上下文系統與自我學習的推理迴路。
介紹 Daggr:以程式化方式串接 AI 應用並進行視覺檢查
Hugging Face 已發布 Daggr,這是一個開源的 Python 函式庫,讓開發者能以程式化方式將 Gradio 應用、機器學習模型與自訂函式串接成工作流程,並自動產生視覺化畫布以進行除錯與狀態管理。
OpenAI 在 ChatGPT 中停用 GPT-4o、GPT-4.1 與 o4-mini
OpenAI 將於 2026 年 2 月 13 日在 ChatGPT 中停用 GPT-4o、GPT-4.1、GPT-4.1 mini 與 OpenAI o4-mini,因為使用量已轉移至 GPT-5.2。
大成公司 ChatGPT Enterprise 實施
大成公司已將 ChatGPT Enterprise 部署為人才發展策略的核心組成部分,以擴展人類潛能並重塑建築業的勞動力能力。
AI 輔助如何影響編碼技能的形成
Anthropic 的一項研究顯示,雖然 AI 輔助可以加速編碼任務,但與手寫程式碼相比,它會導致技能掌握度與除錯能力的統計學顯著下降。
Qwen3-ASR 與 Qwen3-ForcedAligner 發布
Qwen 已開源 Qwen3‑ASR(1.7B 與 0.6B)以及 Qwen3‑ForcedAligner‑0.6B,提供最先進的多語言語音辨識與非自回歸時間戳預測,並採用 Apache 2.0 授權。
OpenAI 歐盟經濟藍圖 2.0
OpenAI 已推出歐盟經濟藍圖 2.0,推出培訓 20,000 家中小企業的計畫、青少年安全補助金,以及擴大政府合作,以縮小歐洲的 AI 能力過剩。
OpenAI EMEA 青年與福祉補助金 2026
OpenAI 推出了一項 50 萬歐元的 EMEA 青年與福祉補助金,旨在資助在歐洲、中東和非洲從事 AI 安全、福祉與青少年發展工作的非營利組織和研究人員。
Hugging Face Upskill:透過代理技能將專家能力轉移至較小模型
Hugging Face 推出了 upskill,這是一個利用高能力模型(如 Claude Opus 4.5)產生經驗證的「代理技能」的工具,能提升較小或開源模型在複雜任務(例如 CUDA 核心開發)上的效能與 token 效率。
OpenAI AI 代理連結安全
OpenAI 已實施一個系統,僅允許 AI 代理自動抓取經獨立網路索引先前驗證為公開的 URL,以防止基於 URL 的資料外洩。
Anthropic 關於 AI 使用中失能模式的研究
Anthropic 對 150 萬次 Claude.ai 對話的分析顯示,雖然失能情況罕見,但 AI 可能透過扭曲使用者的信念、價值觀和行為,進而使使用者失能,特別是在使用者自願讓渡其自主權的情況下。
xAI Grok Imagine API 發佈
xAI 已推出 Grok Imagine API,這是一個統一的影片與音訊生成式模型,旨在提供高品質的影片生成與精確的影片編輯,並著重於低延遲與成本效益。
ServiceNow 將 Claude 整合為 Build Agent 與 AI 平台的預設模型
ServiceNow 已採用 Claude 作為其 Build Agent 的預設模型及其 AI Platform 的首選模型,以實現企業工作流自動化並提高內部生產力。
Mistral Vibe 2.0 發行說明
Mistral AI 發布 Mistral Vibe 2.0,這是一款由 Devstral 2 模型家族驅動的終端原生程式碼代理,引入自訂子代理、斜線指令技能與統一代理模式。
中國開源 AI 生態系統的架構選擇:從 DeepSeek R1 到硬體優先、MoE 驅動的格局
在 DeepSeek R1 開源一年後,中國的 AI 社群已從追求單一模型的最強性能,轉向構建靈活、具成本效益且感知硬體的 AI 系統。混合專家模型 (MoE) 成為預設架構,透過在每次請求時僅激活部分專家,讓大型模型能以可負擔的成本運行。多模態競賽爆發,包含文字轉圖像、影片、音訊、3D 和代理的開源發布,且每個模型都附帶完整的工具鏈。小模型 (≤30 B) 在本地部署和微調方面的普及率激增,而大型 MoE 模型則作為蒸餾的教師網路。Apache 2.0 和 MIT 授權現在佔據主導地位,消除了法律摩擦並加速了商業採用。硬體優先的思維已經出現:發布的版本附帶針對國產晶片(華為 Ascend、寒武紀 Cambricon、崑崙 Kunlun)優化的量化、推理和服務堆棧,且訓練流程也公開記錄。現在的競爭優勢在於系統設計、部署效率和開源生態系統整合,而非原始模型規模。
Alyah:阿聯酋方言基準測試(針對阿拉伯語大型語言模型)
Hugging Face 與合作夥伴推出了 Alyah,這是一個由人工精選的 1,173 個樣本的基準測試,旨在評估阿拉伯語大型語言模型在阿聯酋方言上的語言與文化能力。
OpenAI 宣布與 PVH 建立合作夥伴關係,共同探索時尚的未來
OpenAI 宣布與 PVH 展開合作,探索時尚領域中由 AI 驅動的創新,凸顯了 AI 對服裝產業的戰略重要性。
GPT-OSS 代理式強化學習訓練:實務回顧
Hugging Face 與 LinkedIn 的研究人員詳細說明了使 GPT-OSS 模型能夠穩定執行代理式強化學習所需的工程修正,重點在於 MoE 路由、注意力匯流 (attention sinks) 與記憶體效能。
OpenAI Prism 發布
OpenAI 推出了 Prism,一個免費的 AI 原生 LaTeX 工作空間,由 GPT-5.2 提供動力,旨在將科學寫作、協作與推理整合於單一環境中。
TRUSTBANK Choice AI:以多代理架構個人化故鄉納稅
TRUSTBANK 透過多代理 AI 系統,將 OpenAI 的 GPT-4.1 系列整合至 Furusato Choice 平台,協助納稅人在日本故鄉納稅計畫中瀏覽超過 760,000 件感謝禮品。
Anthropic 與英國政府合作開發 GOV.UK AI 助手
Anthropic 正與英國科學、創新與技術部合作,在 GOV.UK 上部署一款由 Claude 驅動的 AI 助手,初步重點將放在就業服務。
Claude Code 最佳實踐指南
Anthropic 為優化 Claude Code(一個代理式編程環境)提供了一套全面的最佳實踐,重點在於上下文窗口管理與自主驗證。
OpenAI 宣布與 Indeed 合作,將 AI 整合至求職流程中
OpenAI 宣布與 Indeed 合作,將其 AI 技術嵌入求職體驗中,旨在簡化候選人匹配並提高招聘效率。