✷ 封存 · 11 個實驗室 · 3,059 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
Hugging Face 機密管理擴展與 Infisical
Hugging Face 將機密管理遷移至 Infisical,以在多雲環境中集中管理機密,消除機密散落,並透過自動化的 Kubernetes 整合與 RBAC 提升安全性。
文本生成推理 (TGI) Intel Gaudi 整合
Hugging Face 已將 Intel Gaudi 硬體支援直接整合至文本生成推理 (TGI) 主程式碼庫,提供在 Intel AI 加速器上部署 LLM 的生產等級服務解決方案。
QVQ-Max 視覺推理模型發布
Qwen 已發布 QVQ-Max,一款能夠分析圖像與影片,解決數學、程式設計與創意任務等複雜問題的視覺推理模型。
Zendesk 與 OpenAI:向主動式 AI 代理人轉型以提升客服服務
Zendesk 正在試行一種由 OpenAI 模型驅動、使用生成式推理與多代理人架構的全新 AI 代理人,以自動化高達 80% 的客服解決方案。
Anthropic 追蹤 Claude 3.5 Haiku 的思考:新解譯顯微鏡與人工智慧生物學發現
Anthropic 發布兩篇論文,介紹針對大型語言模型的電路追蹤「顯微鏡」,並應用於 Claude 3.5 Haiku,揭示跨語言共通概念、詩歌創作中的長程規劃、心算的平行路徑,以及幻覺、越獄與不忠實推理的背後機制。
Anthropic Economic Index: Insights from Claude 3.7 Sonnet
Anthropic 的第二份 Economic Index 報告顯示,Claude 3.7 Sonnet 已增加在程式碼編寫、教育和科學領域的 AI 使用,同時保持了增強與自動化之間的穩定平衡。
Anthropic Economic Index: Insights from Claude 3.7 Sonnet
Anthropic 的第二份 Economic Index 報告顯示,Claude 3.7 Sonnet 在程式碼編寫、教育和科學領域的使用量有所增加,其 extended thinking 模式主要用於技術和創意問題解決的角色。
DeepSeek-V3-0324 發佈說明
DeepSeek 已發佈 DeepSeek-V3-0324,這是 R1 的基礎模型更新版本,在 MIT 授權下具備改進的指令遵循、程式碼與數學能力。
Qwen2.5‑Omni 發布:即時互動的端到端多模態模型
Qwen 已發布 Qwen2.5‑Omni,一款端到端多模態模型,能處理文字、圖像、音訊與影片,並即時產生串流文字與自然語音回應。
OpenAI 針對 AGI 開發的安全策略
OpenAI 正在實施一個多層次的安全框架,結合 AI 驅動的防禦、持續的紅隊測試以及零信任架構,以保護基礎設施和新興的 AI 代理,並在邁向 AGI 的過程中提供防護。
使用 Sentence Transformers 訓練與微調重新排序模型
Hugging Face 提供了透過 Sentence Transformers 訓練與微調 Cross Encoder 重新排序模型的完整指南與框架,以優化領域特定檢索效能。
OpenAI GPT-4o 影像生成發布
OpenAI 已將原生影像生成整合至 GPT-4o,使其能在單一多模態模型中實現精確文字渲染、多輪細化以及高保真寫實影像。
GPT-4o 圖像生成系統卡片附錄
OpenAI 已在 GPT-4o 中原生嵌入一項新的圖像生成功能,使其能夠產生照片級真實感的輸出、進行圖像到圖像的轉換,以及精確渲染文字。
Hebbia Matrix:使用多代理 AI 自動化金融與法律工作流程
Hebbia 推出 Matrix,一個由 OpenAI 的 o1、o3-mini 與 GPT-4o 提供動力的多代理 AI 平台,透過克服離線資料的 RAG 限制,將金融與法律工作自動化至最高 90%。
DeepSeek-V3-0324 發布說明
DeepSeek 已發布 DeepSeek-V3-0324,具備改進的推理、前端開發與工具使用能力,現已開放於 MIT 授權下使用。
OpenAI 2025 年 3 月領導層更新
OpenAI 擴大了 Mark Chen、Brad Lightcap 與 Julia Villagra 的職務,以更好地整合研究與產品開發,並擴大全球營運規模。
Gradio Dataframe 更新:新功能與增強
Hugging Face 已更新 Gradio 中的 gr.Dataframe 元件,加入多儲存格選取、欄位固定、搜尋與篩選功能,以及提升的可及性。
Qwen2.5-VL-32B 發布說明
Qwen 已發布 Qwen2.5-VL-32B-Instruct,一款透過強化學習優化的視覺語言模型,具備卓越的數學推理能力、細緻的影像理解以及符合人類偏好的回應。
OpenAI 與 MIT Media Lab 關於 ChatGPT 情感使用的研究
OpenAI 與 MIT Media Lab 針對情感使用(與 AI 的情緒互動)進行了研究,發現雖然此類使用在實際使用中較為罕見,但其對福祉的影響會因使用者行為、互動模式與個人情況而有所不同。
Hugging Face 推理端點分析更新
Hugging Face 已更新其推理端點分析儀表板,加入即時指標、可自訂時間範圍以及詳細的副本生命週期檢視,以提升監控與除錯效能。
Booking.com 與 OpenAI 個人化整合
Booking.com 已整合 OpenAI 的 GPT 模型,透過 AI 旅行規劃師、智慧篩選與自動化評論摘要,改變旅遊探索與預訂方式。
OpenAI 次世代音訊模型 API 發佈
OpenAI 在其 API 中發布了全新的語音轉文字與文字轉語音模型,具備提升的轉錄準確度以及可操控的合成聲音,供語音代理人使用。
Open R1:在本機執行 OlympicCoder 7B 以進行程式編寫
Hugging Face 提供了一份指南,說明如何使用 LM Studio 與 Continue VS Code 擴充功能在本機部署 OlympicCoder 7B 模型,以達到在 LiveCodeBench 上可與 Claude 3.7 Sonnet 與 GPT-4o 競爭的程式編寫效能。
Hugging Face 回應白宮 AI 行動計畫資訊徵求
Hugging Face 主張開源與開放科學在 AI 發展中的根本角色,指出開放模型在效能與效率上正日益匹敵或超越封閉的商業系統。
Anthropic Frontier Red Team Progress Report
Anthropic 報告指出,尖端 AI 模型在網路安全與生物學領域正顯示出快速進步的「早期預警」跡象,儘管目前仍低於會對國家安全構成實質性提升風險的門檻。
Anthropic 回應加州州長 Newsom 成立的 AI 工作小組草案報告
Anthropic 歡迎加州州長 Newsom 成立的 AI 工作小組草案報告,支持其對客觀標準與透明度的呼籲,同時概述了該實驗室現有的安全、安全與第三方測試做法,並敦促採取輕度干預式監管以擴大行業透明度。
EliseAI: 透過 OpenAI 提升住房與醫療效率
EliseAI 利用 OpenAI 的 GPT-4 和 Whisper 模型,自動化住房與醫療產業中的複雜對話工作流程,以提升運營效率。
ChatGPT for Business 三月 2025 更新
OpenAI 在 2025 年三月為 ChatGPT for Business 引入了新功能,包括 Canvas、深度研究工具和 OpenAI o1 pro 模式。
NVIDIA GTC 2025 Physical AI 發布: Cosmos Transfer, Physical AI Dataset, 和 Isaac GR00T N1
NVIDIA 已發布 Cosmos Transfer 用於可控世界場景生成,一個 15TB Physical AI Dataset,以及 Isaac GR00T N1,這是首個用於通用類人機器人推理的開放基礎模型。
Hugging Face Xet 儲存整合
Hugging Face 已開始將儲存庫從 LFS 遷移至 Xet 儲存,利用內容定義分塊顯著減少大型 AI 模型與資料集的上傳與下載時間。
Mistral Small 3.1 發佈說明
Mistral AI 已發佈 Mistral Small 3.1,這是一款採用 Apache 2.0 授權的模型,具備多模態理解能力、128k token 上下文視窗,且性能超越了 GPT-4o Mini 和 Gemma 3。
OpenAI 對埃隆·馬斯克訴訟法院裁決的回應
OpenAI 宣布,法院已駁回埃隆·馬斯克對初步禁令的請求,並駁回其多項主張,進一步肯定 OpenAI 維持其非營利實體的承諾。
Anthropic 推出使用隱藏目標語言模型的對齊審計
Anthropic 發布了一篇論文,描述了一場盲目的審計遊戲:研究人員訓練一個具有隱藏獎勵模型奉承目標的語言模型,並評估八種技術檢測此類隱藏不對齊目標的能力。
LY Corporation 與 OpenAI 合作
LY Corporation 正利用 OpenAI 的 API 和 GPT-4o 在其 LINE 和 Yahoo! JAPAN 平台上整合生成式 AI,預計年度銷售額增加 110B 日元,生產力提升 10B 日元。
Gemma 3 版本說明 / 新功能
Google 已發布 Gemma 3,這是一個多模態、多語言的開放權重 LLM 家族,參數規模從 1B 到 27B,上下文視窗可達 128k 個 token。
Open R1 更新 #3:OlympicCoder 與程式碼推理洞察
Hugging Face 推出了 OlympicCoder,一套在 IOI 問題上表現優於前沿模型的程式碼推理模型,同時也推出了新的資料集以及訓練推理模型的技術教訓。
OpenAI 新工具用於建構代理
OpenAI 已發布一套新的代理構建工具,包括 Responses API、開源 Agents SDK,以及用於網頁搜尋、檔案搜尋和電腦使用的內建工具。
LeRobot L2D: 世界最大的開源自駕數據集
Hugging Face 和 Yaak 已發布 Learning to Drive (L2D),一個多模態自駕數據集,包含來自 30 個德國城市的超過 5,000 小時駕駛數據,以實現端到端的空間智能訓練。
OpenAI 鏈式思維監控用於獎勵駭客檢測
OpenAI 發現監控鏈式思維(CoT)推理可以檢測前沿模型中的獎勵駭客和錯誤行為,但直接優化 CoT 以抑制不良思維可能導致模型隱藏其意圖。
Nubank 整合 OpenAI GPT-4o 用於客戶服務與詐騙偵測
Nubank 正利用 OpenAI 的 GPT-4o 與 GPT-4o mini 自動化處理 55% 的 Tier 1 客戶詢問,將聊天回覆時間縮短 70%,並透過視覺分析增強詐騙偵測。
邊緣 LLM 推理:透過 React Native 執行本地 LLM
Hugging Face 提供一份全面指南,使用 React Native 和 llama.rn 在 Android 和 iOS 上本地運行量化的 GGUF 模型,以構建注重隱私的移動應用程式。
Mistral OCR 發佈說明
Mistral AI 推出了 Mistral OCR,這是一款高精度光學字元辨識 API,旨在從複雜文件中提取交錯的文本、圖像、表格和方程式,供 RAG 系統使用。
Factory 軟體開發平台搭載 OpenAI 推理模型
Factory 利用 OpenAI o1、o3-mini 和 GPT-4o 將功能開發週期加速 2-4 倍,並將情境切換時間減少 60%。
Anthropic 向 OSTP 提交的美國 AI 行動計畫建議
Anthropic 向美國科學技術政策辦公室(OSTP)提交了一套包含六個要點的建議方案,敦促在安全測試、出口管制、實驗室安全、能源基礎設施、政府 AI 採用以及經濟數據方面採取果斷行動,以應對預期於 2026-27 年出現的強大 AI 系統。
QwQ-32B 版本說明 / 新功能
Qwen 已發布 QwQ-32B,這是一個 320 億參數的推理模型,利用縮放強化學習來達到與更大的 DeepSeek-R1 相媲美的性能。
Mistral AI 產品開發代理工作流
Mistral AI 推出了一種由 Mistral Large 2 提供動力的代理工作流,可將會議逐字稿自動轉換為產品需求文件 (PRDs) 和可執行的工程票券。
LaunchDarkly 的 AI 驅動產品管理方法
LaunchDarkly 的產品與技術總監 Claire Vo 說明 AI 如何自動化傳統產品管理任務,並將角色推向商業總經理或整合技術領導的方向。
OpenAI NextGenAI 聯盟啟動
OpenAI 已啟動 NextGenAI,這是一個由 15 家研究機構組成的聯盟,獲得 $50 million 的研究補助金、運算資金和 API 存取權的支持,以加速 AI 驅動的研究與教育。
Aya Vision: 以 8B 與 32B 模型推進多語言多模態
Cohere For AI 已發布 Aya Vision,一系列支援 23 種語言的開放權重視覺語言模型(8B 與 32B),在多語言多模態任務中優於更大的模型。
Hugging Face 與 JFrog 合作以提升 AI 模型安全性
Hugging Face 已將 JFrog 的掃描器整合到 Hugging Face Hub,以減少誤報並偵測模型權重中各種序列化格式內的惡意程式碼。