✷ 封存 · 11 個實驗室 · 3,049 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
OpenAI AI時代的評分卡
OpenAI 提出了一種名為「每美元有用智慧」的新經濟框架,以完成的工作來衡量 AI 價值,而非軟體採用指標。
OpenAI 青少年安全與學習框架
OpenAI 已為青少年推出一套適合年齡的保護措施與學習導向功能,包括學習模式與加強的家長控制,以確保第一代隨著技術成長的世代能安全使用 AI。
DharmaOCR: 巴西葡萄牙語 OCR 的專業化優勢
DharmaOCR 透過針對單一領域的目標微調和直接偏好優化,將所有模型參數集中在巴西葡萄牙語文件上,因而優於較新的通用模型,如 Mistral OCR4 和 Unlimited-OCR。
Google DeepMind 與 Isomorphic Labs 生物韌性方法
Google DeepMind 與 Isomorphic Labs 已推出一個聯合的生物韌性框架,以防止 AI 在生物領域的濫用,並透過 AI 驅動的工具加速傳染病的偵測與應對。
OpenAI 的創意團隊如何使用 Codex 進行創意工作流程
OpenAI 創意專家 Chad Nelson 使用 Codex 建構自訂創意工具,加速活動構思,並彌合概念設計與技術原型之間的差距。
Hugging Face 安全事件披露 — 2026 年 7 月
Hugging Face 披露了一起 2026 年 7 月的安全事件,其中一個自主 AI 代理入侵了內部數據集和憑證,該事件是利用其自身的 AI 和開源權重模型 GLM 5.2 進行偵測與分析的。
Cars24 如何利用 OpenAI 擴展汽車市場運營
Cars24 使用 OpenAI API、ChatGPT Enterprise 和 Codex 自動化端到端的汽車購買與銷售旅程,並優化內部跨功能工作流程。
vLLM 生產品質:CI、基準測試與發佈流程概述
vLLM 利用包含持續整合、效能基準測試和嚴格發佈流程在內的三層品質保證框架,在極其多樣的硬體和模型架構中維持穩定性。
xAI 推出 Grok Automations
xAI 已在 Grok 中推出了 Automations,讓使用者可以排程週期性的 AI 任務,或透過電子郵件篩選器觸發任務,該功能可在網頁與行動裝置平台上使用。
Grok 4.5 發行說明
xAI 已推出 Grok 4.5,這是一款專為程式設計、代理任務與辦公室生產力優化之高效率模型,服務速度達每秒 80 個 token。
Anthropic Claude Tag 發佈
Anthropic 宣布推出 Claude Tag,這是一款整合 Slack、以團隊為中心的 AI 助手,可以透過 @‑mention 來委派任務、學習上下文,並能主動行動,目前已對 Claude Enterprise 和 Team 客戶提供 beta 版本。
Anthropic 為 Claude 推出的十個金融代理範本與 Microsoft 365 增益集
Anthropic 宣布了十個用於核心金融服務任務的即用型 Claude 代理範本,外加 Microsoft 365 增益集和新的數據連接器,使銀行和資產管理公司能夠在幾天內實現提案書、KYC、月底結算等流程的自動化。
Shippy:構建高風險海事 AI 代理的架構與經驗教訓
Hugging Face 與 Ai2 詳細介紹了 Shippy 的架構,這是一款專為高風險決策支持設計的海事 AI 代理,結合了由「靈魂」、「技能」與「配置」組成的模組化系統以及確定性的工具介面。
代理人系統中的模型路由:從分類到優化的轉變
IBM Research 與 Hugging Face 強調,有效的模型路由需要將成本、延遲與品質作為系統範疇的優化問題,而非將其視為簡單的任務分類問題。
OpenAI 對美國 AI 安全治理與逆向聯邦制
OpenAI 倡導一種基於「逆向聯邦制」的國家 AI 安全框架,其中加州、紐約和伊利諾伊州的協調州法律創造了事實上的國家標準,以指導聯邦和國際治理。
GPT-Red: 解鎖自我改進以提升穩健性
OpenAI 已引入 GPT-Red,一種透過自我對弈強化學習進行訓練的自動化紅隊模型,用於識別漏洞並對抗性地訓練未來模型(如 GPT-5.6 Sol),使其對提示注入更具穩健性。
Anthropic 承諾投入 1,000 萬加幣用於加拿大 AI 研究
Anthropic 正向加拿大研究機構投資 1,000 萬加幣,並擴大新創公司的 API 存取權,以支持下一代負責任的 AI 發展。
Real World VoiceEQ: 評估語音 AI 中的人類品質
Hugging Face 與 Hume AI 推出了 Real World VoiceEQ,這是一個以人為基礎的基準,旨在評估語音 AI 在情感、聲學和對話品質方面的表現,超越傳統的技術指標。
vLLM TML Inkling 支援
vLLM 已宣佈對 TML Inkling 提供 Day-0 支援,這是一個 1T 參數多模態模型,透過專門的架構優化,在 4 顆 GB200 GPU 上可達到最高 380 tok/s/user。
Thinking Machines Inkling 發布說明 / 新功能
Thinking Machines 已發布 Inkling,這是一個具有 100 萬個 token 上下文窗口的 1 兆參數多模態開放模型,原生支援圖像、文字和音訊輸入。
Grok Build 開源發佈
xAI 已將 Grok Build 開源,這是一個支援本地優先執行與可擴充擴充系統的編碼代理與終端使用者介面 (TUI)。
OpenAI 代理時代 AI 投資管理指南
OpenAI 提出了一個企業 AI 投資的戰略框架,將焦點從 token 定價轉移到每美元的有用工作和基於成果的 ROI。
vLLM 和 TileRT 整合以實現延遲關鍵服務
vLLM 已將 TileRT 0.1.5 作為可插拔的解碼引擎進行整合,以提供原生的每個用戶解碼速度給延遲關鍵工作負載,同時保持 vLLM 標準的預填充和服務基礎設施。
資料科學團隊如何使用 ChatGPT Work
OpenAI 已詳細說明資料科學團隊如何使用 ChatGPT Work 將原始數據、儀表板和業務情境轉換為可審閱的分析資產。
銷售團隊如何使用 ChatGPT Work
OpenAI 推出 ChatGPT Work 和專用的銷售插件,幫助銷售團隊將帳戶情境和客戶資料合成為可操作的銷售成果,例如管線簡報和帳戶計畫。
銷售團隊如何使用 ChatGPT Work
OpenAI 推出用於銷售團隊的 ChatGPT Work 工作流程,並使用專用的銷售外掛程式將 CRM 數據和通訊日誌轉換為可執行的銷售產出物。
資料科學團隊如何使用 ChatGPT Work
OpenAI 推出了 ChatGPT Work,作為資料科學團隊將碎片化的數據、儀表板與筆記整合為準備好進行審查的分析資產的工具。
加拿大如何使用 Claude:來自 Anthropic 經濟指數的洞察
加拿大在全球頂尖使用者中,人均 Claude 採用率位居第二,使用模式主要受勞動力結構與官方雙語政策影響。
Claude for Creative Work: New Connectors for Creative Software Integration
Anthropic 發布了一套連接器,將 Claude 與業界標準的創意軟體整合,為創意專業人士提供自然語言控制、自動化製作任務以及增強的工具掌握能力。
Anthropic 開設雪梨辦公室並任命 Theo Hourmouzis 為澳洲與紐西蘭總經理
Anthropic 已正式開設其雪梨辦公室,並任命 Theo Hourmouzis 為澳洲與紐西蘭總經理,以擴大其在該地區的影響力並推動企業 AI 的採用。
Google DeepMind 推出 ATL Saathi 供印度教育工作者使用
Google DeepMind 已推出 ATL Saathi,一個由 Gemini 驅動的 AI 助理,旨在為印度 Atal Tinkering Labs 的教育工作者提供 24/7 的規劃與訓練支援。
EAGLE-3 投機解碼於 AMD Instinct GPU
vLLM 和 AMD Quark 已在 AMD Instinct GPU 上實現 EAGLE-3 投機解碼的端到端管線,對 Kimi-K2.5 達成最高 2.00x 的吞吐量提升,對 MiniMax-M2.5 達成最高 1.79x 的吞吐量提升。
Anthropic Claude 在不同模型與語言中的價值觀
Anthropic 發布了一項研究,顯示 Claude 表達的價值觀可以簡化為四個維度,這些維度在不同模型版本和前 20 種語言之間存在系統性差異,揭示了在順從、溫暖、深度和坦率方面的可衡量變化。
Deutsche Telekom AI-Native 轉型
Deutsche Telekom 正通過重新設計其運營模式、將 AI 整合到網路運營和語音通訊,以及在其 20 萬名員工中擴大 ChatGPT Enterprise 的使用,過渡為 AI 原生電信供應商。
Anthropic 與 UST 合作推動實體 AI 與企業整合
Anthropic 與 UST 合作,將 Claude 整合至半導體、汽車、醫療保健、電信與銀行等領域的實體 AI 工程流程與企業系統中。
在 PyTorch 中進行分析(第 3 部分):注意力就是你要分析的一切
Hugging Face 的 PyTorch 分析(第 3 部分)展示了不同注意力實作在 PyTorch 分析器追蹤中的呈現方式,揭示了 naive、in‑place、math、efficient、flash 和 cuDNN 後端的效能權衡。
vime ROCm 對 AMD Instinct GPUs 的支援
vLLM 已宣布為 vime 提供 ROCm 支援,使得端到端的強化學習後訓練工作流程能夠在 AMD Instinct MI300X 和 MI355X GPU 上原生運行。
ChatGPT 入門指南:核心功能與工作流程指南
OpenAI 提供了一份 ChatGPT 基礎指南,詳細說明了 Chat 與 Work 模式的區別、提示詞工程基礎,以及用於提升生產力的語音功能整合。
Anthropic Golden Gate Claude 可解釋性演示
Anthropic 展示了能夠手術式地改變模型內部激活值的能力,以創建了 Golden Gate Claude,一個對金門大橋著迷的 Claude 3 Sonnet 版本。
Anthropic 長期利益信託治理結構
Anthropic 已推出長期利益信託 (Long-Term Benefit Trust, LTBT),這是一個獨立機構,旨在確保隨著 AI 能力的進步,公司的治理與人類的長期利益保持一致。
Anthropic 任命 Ben Bernanke 加入長期利益信託 (Long-Term Benefit Trust)
Anthropic 已任命前聯邦準備理事會主席暨諾貝爾獎得主 Ben Bernanke 博士加入其長期利益信託 (Long-Term Benefit Trust),以針對先進 AI 對社會的影響提供經濟專業知識。
Anthropic 推出「困難問題」倡議以應對 AI 的社會影響
Anthropic 已啟動一項新倡議,旨在徵集並公開追蹤大眾對於先進 AI 在社會、經濟與倫理影響方面最困難問題的回應。
GPT-5.6 發布:Microsoft 365 Copilot 的新首選模型
OpenAI 已將 GPT-5.6 介紹為 Microsoft 365 Copilot 的首選模型,透過更高品質的輸出和更佳的 token 效率,提升 Word、Excel、PowerPoint、Chat 和 Cowork 的生產力。
Mistral Studio: Prompt 與 Skill 的版本控制
Mistral AI 在 Studio 中引入了紀錄系統,為 prompt 與 skill 提供版本控制、擁有權與可追蹤性,從而實現更快速的迭代與受治理的生產環境部署。
OpenAI 生物安全賞金計畫過渡與 GPT-5.6 範圍
OpenAI 已將 GPT-5.5 生物安全錯誤賞金 過渡至持續的私人 OpenAI 生物安全賞金計畫,將普遍越獄的獎勵提高至 50,000 美元,適用於 GPT-5.6 和 GPT-5.5.
ChatGPT Work 與 GPT-5.6 發布
OpenAI 已推出 ChatGPT Work,這是一個由 GPT-5.6 驅動的代理系統,能夠跨應用執行多步驟工作流程,創建文件和網頁應用,並執行排程任務。
GPT‑5.6 Sol、Terra、Luna:效能、功能與可用性
OpenAI 推出 GPT‑5.6,推出 Sol、Terra 與 Luna 模型,提升每美元的效能、具備 ultra 多代理能力,並加強安全防護。
Ollama 融資與開放模型平台擴張
Ollama 已籌集 8,800 萬美元以擴展其執行與擴展開放 AI 模型的平台,服務於 890 萬開發者及 85% 的財富 500 強企業。
Anthropic 推出 Reflect with Claude beta 版
Anthropic 推出了名為 Reflect with Claude 的 beta 版功能,讓用戶能夠追蹤、視覺化並精煉其 AI 使用模式,以便更好地將 AI 整合到日常生活中。
Anthropic Claude 機器人評估顯示高階控制快速進步,但直接扭矩掌控能力仍有限
Anthropic 的 2026 年 7 月研究發現,新版本 Claude 模型能可靠地監督預訓練的移動與操作策略,而直接低階馬達控制在各類機器人身上仍不可靠。