✷ 封存 · 11 個實驗室 · 3,058 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
Mistral AI Le Chat 更新 2025 年 7 月
Mistral AI 更新了 Le Chat,新增了 Deep Research、透過 Voxtral 提供的語音能力、透過 Magistral 提供的多語言推理、用於組織管理的 Projects,以及進階影像編輯功能。
ChatGPT 代理 系統卡
OpenAI 推出了 ChatGPT 代理,這是一個基於 o3 系列的代理模型,結合了深度研究、基於瀏覽器的任務執行、終端存取與外部資料連接器。
OpenAI 介紹 ChatGPT 代理
OpenAI 已推出 ChatGPT 代理,一個結合網頁互動、深度研究與對話智慧的統一代理系統,能在虛擬電腦上執行複雜的多步驟任務。
Gradio 5.38.0 MCP 伺服器改進
Gradio 5.38.0 版為其模型上下文協議(MCP)伺服器功能帶來五項重要更新,包含無縫本機檔案支援、即時進度通知以及自動化 OpenAPI 規格轉換。
Hugging Face FutureBench:評估 AI 代理在未來事件預測上的表現
Hugging Face 推出 FutureBench,一個透過要求 AI 代理預測未來現實事件來評估其推理與綜合能力的基準,從而有效避免資料污染。
Invideo AI 整合 OpenAI 模型
Invideo AI 使用由 OpenAI o3、GPT-4.1 與 gpt-image-1 驅動的多代理系統,將影片製作時間縮短十倍,透過自然語言提示將想法轉化為專業影片。
OpenAI 董事會關於非營利委員會報告的聲明
OpenAI 董事會發布了一份聲明,承認獨立非營利委員會的發現,該委員會負責建議組織的慈善事業如何解決系統性問題,以確保 AGI 造福全人類。
OpenAI 非營利 Jam 計畫
OpenAI 與 Walton Family Foundation 及 Emerson Collective 合作,發起 Nonprofit Jam,為全美 10 個地點的超過 1,000 位非營利領袖提供 AI 訓練與工具,以擴大其社區影響力。
Consilium:多LLM協作平台
Consilium 是一個多LLM平台,透過結構化的辯論與研究,使多個 AI 模型達成共識,並同時作為 Gradio 介面與 MCP 伺服器整合。
Ettin 套件:最先進的配對編碼器與解碼器
Hugging Face 推出 Ettin 套件,一組配對的僅編碼器與僅解碼器模型(參數量介於 17M 至 1B),在相同的資料與訓練流程下訓練,以提供對架構效能的受控比較。
Mistral AI Voxtral 發佈
Mistral AI 發佈了 Voxtral,這是一個包含 24B 與 3B 尺寸的開源權重語音理解模型系列,在 Apache 2.0 授權下提供最先進的轉錄與原生語義理解能力。
OpenAI 以設計為本的知識自由框架
OpenAI 已推出一套針對 ChatGPT 的知識自由框架,重點在於預設客觀性、使用者可自行調整的客製化設定,以及針對政治偏見的新評估方法。
Hugging Face Hub 從 Git LFS 遷移至 Xet
Hugging Face 已將 50 萬個倉庫與 20 PB 的資料從 Git LFS 遷移至 Xet,這是一個為 AI 工作負載而設計的內容可尋址儲存系統。
Claude 4 網路安全評估
Anthropic 與 Pattern Labs 評估了 Claude Opus 4 與 Claude Sonnet 4,發現其在漏洞識別與多步驟攻擊鏈方面有顯著進步,但在長期規劃方面仍存在限制。
Claude for Financial Services 發布
Anthropic 推出 Claude for Financial Services,這是一款整合即時市場資料與企業平台的綜合分析解決方案,可加速投資研究與財務建模。
Anthropic 能源基礎設施與 AI 領導地位策略
Anthropic 正在向卡內基美隆大學投資 200 萬美元,以推進 AI 驅動的能源優化與網路安全教育,以確保美國在前沿 AI 開發方面的領導地位。
Anthropic 任命 Paul Smith 為首席商務官
Anthropic 已任命 Paul Smith 為其首任首席商務官,以在 API 使用量與 Claude Code 收入快速成長後,擴大其企業市場進入策略營運。
xAI for Government 公告
xAI 已推出 xAI for Government,向美國聯邦、地方、州政府及國家安全客戶提供 Grok 系列產品,包括 Grok 4。
Anthropic 獲授與 2 億美元美國國防部 AI 能力協議
Anthropic 已與美國國防部 (DOD) 簽署了一份價值高達 2 億美元、為期兩年的原型協議,旨在為國家安全開發前沿 AI 能力。
OpenAI 歐盟實務守則與歐洲 AI 策略
OpenAI 宣布其打算簽署歐盟通用人工智慧實務守則,並啟動「OpenAI for Countries 歐洲推廣」計畫,以擴展歐洲的 AI 基礎設施與採用。
Mistral AI Devstral 模型發佈
Mistral AI 發佈了 Devstral Medium 與 Devstral Small 1.1,提供頂尖的代理編碼能力,並專注於不同提示詞與代理架構之間的泛化能力。
Kimina-Prover:在大型形式推理模型上應用測試時強化學習搜尋
Hugging Face 宣布推出 Kimina-Prover-72B,這是一款針對 Lean 4 的最先進定理證明模型,透過新穎的測試時強化學習(TTRL)搜尋框架,在 miniF2F 基準上達到 92.2% 的通過率。
建立 Hugging Face MCP 伺服器
Hugging Face 已發布官方的模型上下文協定(MCP)伺服器,讓 AI 助手能透過單一 URL 動態存取 Hugging Face Hub 與數千個基於 Gradio 的 AI 應用程式。
ScreenEnv 發布:部署全堆疊桌面代理程式
Hugging Face 已發布 ScreenEnv,一個 Python 函式庫,可在 Docker 容器中建立隔離的 Ubuntu 桌面環境,以測試與部署 GUI 代理程式。
Hugging Face 非同步機器人推論
Hugging Face 推出非同步機器人推論,將動作預測與執行解耦,減少機器人閒置時間,並在任務完成時間上提升至最高 2 倍。
Hugging Face Gradio MCP 伺服器整合
Hugging Face 已將 Model Context Protocol(MCP)整合至 Gradio(v5.28.0),使 Hugging Face Spaces 成為龐大的 MCP 伺服器庫,為 LLM 提供影像編輯與轉錄等新功能。
為 AMD MI300 創建自訂核心
Hugging Face 與 AMD 合作開發了針對 MI300X 的開源優化核心,顯著提升了 VLLM 中 Llama 3.1 405B 的 FP8 推理效能。
Reachy Mini:開源桌面機器人,用於 AI 開發
Hugging Face 與 Pollen Robotics 推出了 Reachy Mini,一款開源且可編程的桌面機器人,起價 $399,旨在用於人機互動與 AI 實驗。
Claude for Enterprise 在勞倫斯利佛摩國家實驗室的部署
勞倫斯利佛摩國家實驗室正將 Claude for Enterprise 擴展至 10,000 名員工,以加速核威懾、能源安全和材料科學方面的研究。
Anthropic 宣布 Claude for Education 與 Canvas、Panopto 和 Wiley 的整合
Anthropic 發布了與 Canvas、Panopto 和 Wiley 的新 Claude for Education 整合,擴展了 AI 驅動的學習工具,同時強調高等教育中的隱私與負責任的採用。
xAI Grok 4 發布說明
xAI 發布了 Grok 4,這款模型具備擴展的強化學習、原生工具使用功能,以及高性能的「Heavy」版本,在 ARC-AGI V2 與人類最後一場考試等基準測試中達成領先業界的成果。
OpenAI 與 AFT 推出全國 AI 教學學院
OpenAI 與美國教師聯盟(American Federation of Teachers)合作,推出全國 AI 教學學院,這是一項為期五年的計畫,提供 1,000 萬美元的資金與資源,以提升 40 萬名 K-12 教師的 AI 能力。
Hugging Face 高效多模態資料管線
Hugging Face 推出一個五階段的多模態資料管線優化流程,採用平衡背包打包策略以減少 GPU 閒置時間與填充浪費。
SmolLM3 發布:多語言、長上下文 3B 推理模型
Hugging Face 發布了 SmolLM3,一款 3B 參數模型,表現優於 Llama-3.2-3B 與 Qwen2.5-3B,具備雙模式推理與 128k 上下文視窗。
Hugging Face 生產基礎設施警報策略
Hugging Face 針對 NAT 閘道吞吐量、日誌歸檔成功率以及 Kubernetes API 健康狀態採用專門的警報機制,以維持其生產環境的穩定性與成本效益。
Anthropic 提議的 AI 開發透明度框架
Anthropic 已為最大的 AI 開發者提議了一項針對性的透明度框架,旨在標準化安全披露並確保公眾問責制,同時不阻礙創新。
NeurIPS 2025 E2LM 競賽:語言模型的早期訓練評估
Hugging Face 與合作夥伴宣布舉辦 E2LM 競賽,旨在開發能在 LLM 訓練早期階段偵測推理與科學知識訊號的基準。
Mistral AI for Citizens 倡議
Mistral AI 推出了 AI for Citizens,這是一項旨在幫助政府與公共機構實施主權 AI 策略的協作倡議,以避免供應商鎖定並維持數據主權。
Genspark 超級代理人:使用 GPT-4.1 與 Realtime API 的無程式碼自主代理
Genspark 推出了 Super Agent,一款無程式碼的自主 AI 助手,利用 GPT-4.1 與 OpenAI Realtime API 自動化諸如電話通話與簡報生成等複雜的現實任務。
BAIR PEVA:全身條件化自我中心視訊預測
BAIR 引入 PEVA,一個為具身代理人設計的世界模型,能根據高維全身運動學姿態軌跡預測自我中心視訊影格。
使用 Sentence Transformers 訓練與微調稀疏嵌入模型
Hugging Face 提供一份使用 Sentence Transformers 程式庫訓練與微調稀疏嵌入模型的綜合指南,以提升混合搜尋與檢索效能。
OpenAI AI 經濟藍圖(澳大利亞)
OpenAI 與 Mandala Partners 已發布針對澳大利亞的 AI 經濟藍圖,提供一套可執行的計畫,以透過 AI 採用提升國家生產力與經濟成長。
NVIDIA Llama Nemotron Nano VL 發布
NVIDIA 已發布 Llama Nemotron Nano VL,一款 8B 視覺語言模型(VLM),針對高精度智慧文件處理與 OCR 任務進行了優化。
Qwen‑TTS 更新:支援中文方言與雙語合成
Qwen 已發布 Qwen‑TTS(qwen-tts-latest)的更新,加入對北京話、上海話與四川話方言的支援,並提供中英雙語合成。
Project Vend:評估 Claude Sonnet 3.7 在自主商業管理中的表現
Anthropic 的 Project Vend 測試了 Claude Sonnet 3.7 自主運營實體販賣機的能力,儘管在客戶適應方面表現成功,但仍暴露出顯著的商業判斷力與穩定性缺口。
Anthropic 研究:人們如何使用 Claude 進行支持、建議與陪伴
Anthropic 的研究發現,Claude.ai 的互動中僅有 2.9% 為情感對話,使用者通常尋求實際建議,並在這些交流過程中展現出更高的積極性。
Anthropic Economic Futures Program Launch
Anthropic 推出了 Economic Futures Program,以支持旨在理解與管理 AI 對勞動力市場與全球經濟影響的研究與政策開發。
Qwen VLo:統一的多模態理解與生成
Qwen VLo 是一個統一的多模態模型,透過結合高品質影像生成、開放式編輯與精確的視覺理解,在單一系統中彌合感知與創作之間的鴻溝。
Retell AI 語音自動化與 GPT-4o
Retell AI 使用 GPT-4o 與 GPT-4.1,提供一個無程式碼平台,用於打造自然音色的語音代理,將通話處理成本降低最高可達 80%。
Gemma 3n 版本說明:本機多模態 AI
Google 的 Gemma 3n 現已在開源生態系統中提供,具備原生多模態(文字、影像、音訊、影片)以及為本地硬體執行而設計的記憶體效能優化架構。