✷ 封存 · 11 個實驗室 · 3,059 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
Anthropic 系列 E 輪融資與戰略性成長
Anthropic 已在系列 E 輪融資中籌得 35 億美元,融資後估值達 615 億美元,用於推動下一代 AI 系統的發展並擴大運算能力。
OpenAI 與美國國家實驗室 1,000 位科學家 AI Jam Session
OpenAI 與美國能源部在九個國家實驗室舉辦「1,000 位科學家 AI Jam Session」,利用前沿 AI 模型(如 o3-mini)加速科學發現。
追蹤與評估 smolagents 與 Arize Phoenix
Hugging Face 示範如何結合 Arize Phoenix 與 smolagents,實作即時追蹤與 LLM-as-a-judge 評估,以支援代理工作流程的可觀測性與效能衡量。
Anthropic 與美國國家實驗室合作舉辦 1,000 位科學家 AI Jam
Anthropic 正與美國能源部合作舉辦首屆 1,000 位科學家 AI Jam,以評估 Claude 3.7 Sonnet 在科學研究與國家安全應用方面的能力。
Mercari 與 GPT-4o mini 的 AI 整合
Mercari 已將 GPT-4o mini 與其他 OpenAI 模型整合,以自動化產品列表生成並優化銷售建議,從而提升列表轉換率和每位使用者的平均銷售額。
OpenAI GPT-4.5 研究預覽
OpenAI 已發布 GPT-4.5,這是一個大規模通用模型,旨在提供更廣泛的知識、提升情感智能並減少幻覺,相較於 GPT-4o。
使用 o1 和 o3-mini 建構自主財務分析師
Endex 正利用 OpenAI 的 o1 和 o3-mini 推理模型來構建一個能夠進行複雜資料合成、多模態分析和精確財務推理的自主 AI 財務分析師。
Hugging Face 與 IISc 合作開源 Vaani 資料集
Hugging Face 已與印度科學學院(IISc)和 ARTPARK 合作,提供全球存取 Vaani 的途徑,Vaani 是一個龐大的多模態、多語言資料集,旨在代表印度的語言多樣性。
Anthropic Transparency Hub Launch
Anthropic 已推出 Transparency Hub,旨在提供一個統一的框架來報告安全協定、風險緩解策略和營運指標,以確保 AI 系統是安全且值得信賴的。
Claude and Alexa+ Integration
Anthropic 已宣布 Claude 模型現在為 Alexa+ 提供動力,透過 Amazon Bedrock 整合了先進的 AI 能力與安全功能,並將於未來幾週內在美國開始推出。
OpenAI Deep Research 系統卡
OpenAI 已推出 Deep Research,這是一種由早期版本 o3 優化以進行網頁瀏覽的代理能力,用於執行複雜任務的多步驟網際網路研究。
FastRTC:Python 即時通訊函式庫
Hugging Face 發布了 FastRTC,這是一個 Python 函式庫,旨在透過處理 WebRTC 與 WebSocket 通訊層,簡化即時音訊與視訊 AI 應用程式的開發。
Anthropic 研究:預測語言模型中的罕見行為
Anthropic 開發了一種利用冪律分佈的方法,根據小規模的部署前評估,來預測部署規模下罕見且危險的 AI 行為。
Ollama Minions: 本地與雲端 LLM 混合協作
Ollama 推出了 Minions,這是一個由 Stanford Hazy Research 開發的框架,透過將工作負載委派給 Llama 3.2 等本地模型,在維持高效率的同時降低了雲端 LLM 成本。
QwQ-Max-Preview 發布
Qwen 已推出 QwQ-Max-Preview,這是一個基於 Qwen2.5-Max 的預覽推理模型,在數學、編碼和 Agent 相關工作流程中表現出色。
Hugging Face 遠端 VAEs 用於推理端點
Hugging Face 推出了一項實驗功能,將 VAE 解碼過程委派給遠端端點,以降低在消費級 GPU 上進行高解析度圖像和影像合成所需的 VRAM 需求。
Claude 3.7 Sonnet 延長思考模式發布
Anthropic 發布了 Claude 3.7 Sonnet,具備可切換的延長思考模式,讓模型能為複雜問題分配更多運算資源,並向使用者提供可見的原始思考過程。
Claude 3.7 Sonnet 與 Claude Code 發布
Anthropic 已發布 Claude 3.7 Sonnet,這是首款具備即時回應與擴展思考能力的混合推理模型,並同步推出了用於 agentic coding 的命令列工具 Claude Code。
OpenAI 阻斷惡意使用 AI
OpenAI 已發布一份報告,詳細說明其為阻斷惡意使用 AI 所做的努力,重點在於防止國家關聯的威脅行為者和威權政權利用 AI 進行隱密影響行動和網路活動。
SigLIP 2 版本說明 / 新功能
Google 已發布 SigLIP 2,這是一系列多語言視覺-語言編碼器,在零樣本分類、圖像-文本檢索以及 VLM 轉移性能方面,在所有規模上都優於原始 SigLIP。
Uber AI 整合適用於隨需服務
Uber 使用 OpenAI 的技術來個人化使用者互動、自動化複雜的市場解決方案,並透過 AI 驅動的副駕駛提升員工生產力。
SmolVLM2: 讓每台設備都能理解影片
Hugging Face 已發布 SmolVLM2,這是一系列高效的視覺與影片語言模型,參數規模為 2.2B、500M 和 256M,旨在讓從手機到伺服器的設備能夠在本地進行影片理解。
Anthropic Crosscoder Model Diffing 研究
Anthropic 的可解釋性團隊正在探索 Crosscoder Model Diffing 以分析 AI 模型之間的差異,並作為初步研究結果呈現。
PaliGemma 2 Mix 發布說明
Google 已發布 PaliGemma 2 mix,一系列在包括 OCR、字幕生成和物體偵測等多樣化任務上進行微調的視覺語言模型,以展示 PaliGemma 2 預訓練檢查點的潛力。
Grok 3 Beta 發佈說明 / 有什麼新功能
xAI 推出了 Grok 3 Beta,這是一個具備先進推理能力與 DeepSearch 代理程式的新模型系列,其訓練是在 Colossus 超級集群上完成的,運算量是先前 SOTA 模型的 n/a
OpenAI SWE-Lancer 基準測試發布
OpenAI 已推出 SWE-Lancer,一個包含超過 1,400 個來自 Upwork 的真實世界自由職業軟體工程任務的基準測試,用於衡量 AI 模型在軟體開發中的經濟影響和技術能力。
Hugging Face 新增 Hyperbolic、Nebius AI Studio 與 Novita 作為無伺服器推理提供者
Hugging Face 已將 Hyperbolic、Nebius AI Studio 與 Novita 整合為無伺服器推理提供者,透過 Hub 和用戶端 SDK 直接擴展對 DeepSeek-R1 和 FLUX.1 等模型的存取。
Mistral Saba:專為中東與南亞地區設計的語言模型
Mistral AI 發布 Mistral Saba,這是一款針對阿拉伯語與印度語系語言優化、具備更高準確性與更低延遲的 240 億參數模型,優於更大規模的通用模型。
OpenAI 與 Guardian Media Group 內容合作夥伴關係
OpenAI 與 Guardian Media Group 已建立策略合作夥伴關係,將 Guardian 的編輯內容整合至 ChatGPT 中,為每週 3 億名用戶提供直接獲取值得信賴的報導與詳細摘要的管道。
Hugging Face Open LLM Leaderboard 更新:整合 Math-Verify 以改進數學評估
Hugging Face 使用 Math-Verify 在 Open LLM Leaderboard 上重新評估了 3,751 個模型,以修復解析錯誤和格式嚴格性,導致 MATH-Hard 排名顯著重新排列。
Hugging Face 將 Fireworks.ai 整合為推理提供者
Hugging Face 已將 Fireworks.ai 添加為 Hub 上支援的推理提供者,使得像 DeepSeek-R1 和 Llama-3.2-90B-Vision-Instruct 這樣的模型能夠在 HF 生態系統中進行無伺服器推理。
Anthropic 與英國政府簽署 MOU 以轉型公共服務
Anthropic 已與英國科學、創新與技術部簽署了諒解備忘錄,以探索使用 Claude AI 來增強公共服務並建立負責任的部署實踐。
Fanatics Betting and Gaming 在財務中的 AI 實施
Fanatics Betting and Gaming 正在利用 ChatGPT 和自訂 GPTs 來自動化手動財務任務,減少每月工作量並加速戰略決策。
Wayfair AI 實施與策略
Wayfair 正在整合 OpenAI 的生成式 AI 和多模態功能,以個人化電子商務體驗、現代化舊程式碼庫,以及自動化法律工作流程中的風險分析。
Rogo 使用 OpenAI o1 和 GPT-4o 擴展金融研究
Rogo 利用具備 OpenAI o1 和 GPT-4o 的分層模型架構來自動化金融研究與盡職調查,使分析師每週節省超過 10 小時。
Hugging Face: 優化 10 億次分類的成本與延遲
Hugging Face 提供了一個框架和基準,用於降低大規模編碼器模型推理的成本,表明 NVIDIA L4 GPU 和優化的批次大小可以以低至 253.82 美元處理 10 億次文本分類。
OpenAI Model Spec 更新
OpenAI 已在 CC0 許可證下發布更新的 Model Spec,以定義 AI 行為,優先考慮使用者自訂性與知識自由,同時維持安全防護措施。
Hugging Face 影片資料集腳本
Hugging Face 推出了ชุด開源影片資料集腳本,旨在簡化用於微調影片生成模型的高品質、經過過濾的資料集建立過程。
Hugging Face Xet支援的儲存庫:透過區塊層級聚合加速 Hub 傳輸
Hugging Face 正在推出一個基於區塊的去重複系統,使用 xet-core 和 hf_xet,透過區塊層級聚合將上傳和下載速度提升 2-3 倍。
Anthropic 關於巴黎 AI 行動峰會的聲明
Anthropic CEO Dario Amodei 呼籲全球針對 AI 安全、AI 開發中的民主領導地位以及經濟動盪採取緊急行動,因為 AI 的能力預計在 2026-2030 年間達到「天才國家」的水平。
Open R1 更新 #2:OpenR1-Math-220k 數據集與推理見解
Hugging Face 推出 OpenR1-Math-220k,這是一個大規模的數學推理數據集,旨在重建 DeepSeek R1 的蒸餾管道,同時分享社區對 GRPO 和 Chain-of-Thought 長度控制的見解。
OpenAI 與 Schibsted Media Group 合作夥伴關係
OpenAI 已與 Schibsted Media Group 合作,將 VG、Aftenposten、Aftonbladet 和 Svenska Dagbladet 等標題的高品質北歐新聞內容整合到 ChatGPT 中。
開放阿拉伯語 LLM 排行榜 2
Hugging Face 與其合作夥伴已發布開放阿拉伯語 LLM 排行榜 2(OALL v2),使用本地阿拉伯語數據集和新的 RAG 評估框架取代飽和及機器翻譯的基準測試,以更準確地衡量阿拉伯語語言能力。
Anthropic 經濟指數的推出與初步發現
Anthropic 宣布推出經濟指數,這是一項基於百萬筆 Claude.ai 對話資料的數據驅動研究,探討人工智能在各職業中的應用情況,並釋出底層資料集供開放研究使用。
Anthropic經濟指數:分析AI對勞動市場的影響
Anthropic推出了經濟指數與配套的開源資料集,用以追蹤AI在真實職業任務中的實際應用,揭示目前AI更傾向於增強而非自動化。
OpenAI 介紹智慧時代
OpenAI 將智慧時代定義為由 AI 推動的技術進步新時代,強調其作為提升人類生產力、創造力和科學發現的工具的角色。
Mistral AI le Chat 更新 2025 年 2 月
Mistral AI 公佈了更新後的 le Chat AI 助手,具備高速推理、整合網路搜尋、代碼執行,以及全新的 Pro、Team 與 Enterprise 分層服務。
Lyft 整合 Claude AI 以提升乘客與駕駛體驗
Lyft 正與 Anthropic 合作,在全平台部署 Claude AI,並已透過 Amazon Bedrock 實現了客戶服務解決時間減少 87% 的成果。
OpenAI 數據居留在歐洲與全球擴展
OpenAI 已在歐洲推出數據居留選項,並將這些功能擴展至全球,以協助組織滿足本地數據主權與合規需求。
OpenAI 與加州州立大學系統部署 ChatGPT Edu
OpenAI 與加州州立大學(CSU)系統已啟動至今最大規模的 ChatGPT 部署,為 23 個校園的超過 520,000 名學生和教職員提供 ChatGPT Edu 的存取權。