封存 · 11 個實驗室 · 3,049 篇 dispatch

實驗室

不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。

551

使用 Codex 建構自我改進的稅務代理

OpenAI 與 Thrive Holdings 開發了 Tax AI,這是一個為 Crete 會計師設計的自我改進代理,利用 Codex 驅動的迴圈來自動化複雜的稅務申報,準確度最高可達 97%。

552

Reachy Mini 本地語音後端整合

Hugging Face 已為 Reachy Mini 發布了一個本地語音轉語音管線,使機器人能夠使用級聯的 VAD、STT、LLM 和 TTS 堆疊完全在本地處理對話。

553

TRL 中的 Delta Weight Sync 實現極低頻寬的兆級參數模型訓練

Hugging Face 宣佈在 TRL 中推出 Delta Weight Sync 功能,該功能通過 Hugging Face Buckets 僅傳輸稀疏的權重變化,將非同步 RL 訓練中的權重同步頻寬降低了 100 倍以上,從而實現了無需共享集群的解耦訓練。

554

OpenAI 2026 年選舉資訊與防護措施

OpenAI 已宣布針對 2026 年選舉週期的一套全面防護措施,重點放在可靠資訊的呈現、網路基礎設施防禦、內容來源追蹤以及防止模型偏見。

555

Warp Open Agentic Development 與 Oz 編排平台

Warp 正使用 GPT-5.5 及其 Oz 編排平台實作 Open Agentic Development,以將軟體工程轉向由人類監督的代理艦隊。

556

Anthropic 開設米蘭辦公室以支持義大利企業與研究

Anthropic 在米蘭開設了新的辦公室,這是其第六個歐洲據點,旨在支持義大利企業、開發者和研究機構在負責任地擴展 Claude AI 的過程中提供協助。

557

Grok 集成於 Kilo Code

xAI 已將 Grok 模型(包括 Grok Build)整合至 Kilo Code 代理工程平台,供 X Premium+ 或 SuperGrok 訂閱的使用者使用。

558

社科領域中的編碼代理 (Coding Agents)

Anthropic 對 1,260 名社會科學家的調查顯示,雖然 81% 使用 AI 聊天機器人,但僅有 20% 採用了自主編碼代理,且在性別、職涯階段與機構聲望之間存在顯著的採用差距。

559

EAGLE 3.1 版本說明:提升推測解碼的韌性與效率

EAGLE 3.1 引入架構改進以解決注意力漂移,在長上下文工作負載中將可接受長度提升至兩倍,並透過 vLLM 與 TorchSpec 整合顯著提升吞吐量。

560

Anthropic 任命 KiYoung Choi 為韓國代表董事

Anthropic 已任命 KiYoung Choi 為韓國代表董事,以領導進入市場策略並支持 Claude.ai 在南韓市場的高採用率。

561

Hugging Face AI Agent 術語表:定義 Harness、Scaffold 與 Agent 架構

Hugging Face 為 AI Agent 提供了一套標準化詞彙,將 Agent 定義為模型 (model)、用於執行的 harness 以及用於定義行為的 scaffolding 的結合體。

562

OpenAI、Grupo Folha 與 Grupo UOL 戰略內容合作夥伴關係

OpenAI 與巴西的 Grupo Folha 和 Grupo UOL 達成合作,將高品質巴西新聞整合至 ChatGPT,為全球 9 億週活躍用戶提供有根據且標註來源的報導。

563

OpenAI 分析: AI 作為小型企業的首位僱員

OpenAI 報告指出,美國四百萬用戶在 2026 年 3 月使用 ChatGPT 支援小型企業運營,減少行政負擔並降低創業的固定成本。

564

Anthropic 如何在各產品中管控 Claude —— 工程概覽

Anthropic 宣布其針對 Claude 代理的多層管控策略,詳細說明了環境沙箱、人機協同控制與出站過濾,以在 claude.ai、Claude Code 與 Claude Cowork 中限制影響範圍。

565

Anthropic共同創辦人Chris Olah談教宗良十四世《Magnifica humanitas》通諭

Anthropic共同創辦人Chris Olah強調,需要宗教與公民社會領袖提供外部的道德與哲學監督,以平衡人工智慧發展中的商業與地緣政治動機。

566

xAI Grok Build 早期測試版發佈

xAI 已推出 Grok Build,這是一款專為專業軟體工程設計的編碼代理,透過「計畫-審查-批准」工作流程和平行子代理執行來處理複雜的編碼任務。

567

Mistral AI 收購 Emmi AI 以推動工業工程領域的物理 AI 發展

Mistral AI 收購 Emmi AI,將物理 AI 能力整合至其生態系中,使航空航太與汽車等高風險工業領域得以實現即時模擬與數位雙生模型。

568

Mistral Medium 3.5 與 Vibe 遠端代理程式發佈

Mistral AI 發佈了 128B 開放權重模型 Mistral Medium 3.5,並在 Mistral Vibe 中推出了基於雲端的遠端編碼代理程式,以及 Le Chat 中的全新 Work mode,用於非同步、多步驟任務的執行。

569

Mistral AI 連接器發行說明 / 最新功能

Mistral AI 已在 Studio 發布連接器,讓開發者能透過內建與自訂的 Model Context Protocol (MCP) 連接器,以程式化 API/SDK 存取方式整合企業資料。

570

Virgin Atlantic 軟體開發與 OpenAI Codex

Virgin Atlantic 利用 OpenAI Codex 推出全新行動應用程式,實現零 P1 缺陷,並將遺留程式碼基礎規模縮減至最高 80%。

571

OpenAI Codex 獲評 2026 Gartner 魔力象限企業 AI 程式碼代理領導者

OpenAI 被認定為 Gartner 魔力象限企業 AI 程式碼代理的領導者,彰顯了 Codex 的規模與治理能力。

572

Anthropic 研究:衡量大型語言模型的漏洞開發能力

Anthropic 的 Claude Mythos Preview 在 V8、Linux 核心和智慧合約上展現出端到端漏洞開發能力的顯著躍進,遠超先前的前沿模型。

573

Project Glasswing:Anthropic 關於 AI 驅動漏洞發現的初步更新

Anthropic 的 Project Glasswing 利用 Claude Mythos Preview 模型,在系統性軟體中識別出超過 10,000 個高風險或嚴重等級的漏洞,將資安瓶頸從漏洞發現轉移至驗證與修補。

574

Google DeepMind 亞太區加速器計畫

Google DeepMind 在亞太地區推出了「AI for the Planet」加速器計畫,協助新創公司、研究團隊與非營利組織擴展前沿 AI 解決方案,以應對環境風險。

575

AdventHealth 與 OpenAI:擴展 AI 以減少臨床行政負擔

AdventHealth 正部署 ChatGPT for Healthcare,以自動化耗時的文件撰寫和臨床工作流程,收回臨床醫師的時間以擴展患者護理容量。

576

Qwen3.7-Max 代理模型發布

Qwen 發布了 Qwen3.7-Max,一款專注於代理的基礎模型,擅長程式碼編寫、辦公自動化以及超長時程自主任務,現已透過阿里雲 Model Studio 提供。

577

OpenAI 教育國家計畫項目更新

OpenAI 正在擴大其 Education for Countries 計畫,以納入新加坡,並擴大研究驅動的 AI 部署,覆蓋其首批夥伴國家,透過具代理能力的 AI 改善學習成果。

578

OpenAI 模型推翻平面單位距離猜想

一個 OpenAI 通用推理模型自主地透過發現相對於正方形網格構造的多項式改進,推翻了離散幾何學中一個 80 年舊的猜想。

579

Codex with GPT-5.5 加速了 Ramp 的代碼審查

Ramp 工程師使用 Codex with GPT-5.5 在幾分鐘內獲得實質性的 pull-request 反饋,而非耗費數小時,並藉此構建如 On-Call Assistant 之類的內部代理型工具。

580

OpenAI for Singapore 合作夥伴公告

OpenAI 已推出『OpenAI for Singapore』,這是與數位發展與資訊部合作的 S$3 億計畫,旨在設立應用人工智慧實驗室並培育當地人工智慧人才。

581

OlmoEarth v1.1 版本說明 / 新功能

Hugging Face 與 AllenAI 已發布 OlmoEarth v1.1,這是一系列地球觀測模型,可將計算成本降低最高達 3倍,同時保持與 v1 相近的性能。

582

OpenAI 內容來源更新

OpenAI 正在實施一個多層次的來源系統,使用 C2PA 符合性、Google SynthID 浮水印以及新的公開驗證工具,以提升 AI 生成內容訊號的透明度與耐久性。

583

Qwen3.5-LiveTranslate-Flash 版本說明

Qwen3.5-LiveTranslate-Flash 是基於 Qwen3.5-Omni 的同聲傳譯模型,提供即時、多模態的翻譯,支援 60 種語言,具備超低延遲與語音克隆功能。

584

Ettin Reranker 系列 v1 版本說明

Hugging Face 發布了 Ettin Reranker 系列,六款參數從 17M 到 1B 的 CrossEncoder 重新排序模型,從 mxbai-rerank-large-v2 蒸餾而成,達到最先進的檢索重新排序品質與速度。

585

Anthropic 將多元智慧傳統納入 AI 道德形成之倡議

Anthropic 正與來自 15 個以上宗教和跨文化團體的學者、神職人員和哲學家進行交流,以為其 AI 系統的道德形成和性格發展提供參考。

586

OpenClaw 的 Grok 整合

xAI 已在 OpenClaw 中啟用 Grok 模型,OpenClaw 是一款可與多個通訊平台整合的開源、優先本地的個人助理。

587

KPMG 與 Anthropic 建立戰略聯盟,推動全球 Claude 整合

KPMG 正將 Anthropic 的 Claude 整合至其全球超過 276,000 名員工的團隊中,並將 AI 嵌入其 Digital Gateway 平台,以強化稅務、法律及私募股權服務。

588

Google DeepMind:快速推進基因線索以逆轉細胞老化

Google DeepMind 的 Co-Scientist AI 正透過識別新穎基因因子,加速細胞老化研究,並將資料分析時間從六個月縮短至數天。

589

PaddleOCR 3.5 版本說明 / 新功能

PaddleOCR 3.5 引入 Hugging Face Transformers 作為支援的推論後端,讓 OCR 與文件解析模型能更順暢地整合到基於 PyTorch 的工作流程中。

590

OpenAI 與 Dell Technologies 合作以部署企業級 Codex

OpenAI 與 Dell Technologies 已合作,透過 Dell AI Data Platform 與 Dell AI Factory,在混合及內部部署的企業環境中啟用 Codex 的部署。

591

vLLM x Novita AI: PegaFlow 用於生產級外部 KV Cache

vLLM 與 Novita AI 宣布推出 PegaFlow,這是一個外部 KV cache 服務,它將 KV cache 與 vLLM worker 解耦,實現了更快的啟動速度、透過快取共享獲得更高的吞吐量,以及基於 RDMA 的跨節點存取。

592

xAI Grok 4.3 Skills 發佈

xAI 已為 Grok 4.3 推出 Skills 功能,可在 Web、iOS 和 Android 平台上實現持續的專業知識並自動生成可直接用於生產環境的辦公文件。

593

Anthropic 收購 Stainless

Anthropic 已收購 Stainless,透過將先進的 SDK 和 MCP 伺服器工具整合到 Claude 平台中,以增強 Claude agent 的連接性。

594

Project Genie Street View 整合

Google DeepMind 已將 Google Street View 影像整合至 Project Genie,使通用世界模型能夠為 AI 代理和使用者生成互動且具體的真實世界環境。

595

Gemini Omni Flash 發布

Google DeepMind 已推出 Gemini Omni Flash,這是一種原生多模態模型,能夠從文字、圖像、音訊和影片輸入的組合生成和編輯高品質影片。

596

Google Antigravity 2.0 公告

Google DeepMind 宣布了 Google Antigravity 2.0,然而提供的來源資料僅為重定向通知,未包含任何技術細節。

597

Gemini for Science: 科學發現的 AI 工具

Google DeepMind 已推出 Gemini for Science,這是一套旨在透過假設生成、計算發現和文獻綜合來加速科學方法的 AI 工具與實驗套件。

598

TITLE: Google DeepMind 內容透明與驗證工具更新

SUMMARY: Google DeepMind 正在擴展 SynthID 浮水印和 C2PA Content Credentials,覆蓋 Search、Gemini、Chrome 和 Pixel,以協助使用者識別 AI 生成的內容與原生相機捕獲的真實內容。

599

Google DeepMind 與 Singapore 國家 AI 夥伴關係

Google DeepMind 正與 Singapore 政府合作,部署前沿 AI 於醫療、教育和永續領域,以期在 2040 年前創造潛在的 S$3.3 billion 經濟價值。

600

Google DeepMind Co-Scientist 用於傳染病研究

劍橋大學的 Clare Bryant 教授正在使用 Google DeepMind 的 Co-Scientist 來識別人畜共通病原體中的分子開關,將識別精確氨基酸目標的時間從數年縮短至數月。