✷ 封存 · 11 個實驗室 · 3,057 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
OpenAI GPT-5 發布說明
OpenAI 已發布 GPT-5,一個具備即時路由器的統一 AI 系統,該路由器能在快速模型與更深度推理模型之間切換,以在編碼、數學和健康領域提供專家級智能。
OpenAI 與 GSA 合作:為美國聯邦員工提供 ChatGPT Enterprise
OpenAI 為全體美國聯邦行政部門員工提供 ChatGPT Enterprise,收取每個機構每年 1 美元的象徵性費用,以減輕行政負擔並提升公共服務的交付。
Anthropic 任命 Hidetoshi Tojo 為日本負責人並宣布設立東京辦公室
Anthropic 已任命 Hidetoshi Tojo 為日本負責人,並將在東京開設其首個亞洲辦公室,以擴大在地業務並支持日本企業採用負責任的 AI。
OpenAI 估算開放權重大型語言模型的最壞情境前沿風險
OpenAI 透過使用惡意微調 (MFT) 來嘗試在生物學與網路安全領域引發最大能力,評估釋出 gpt-oss 的風險,結果發現該模型相較於現有的開放權重模型,並未顯著推進風險的前沿。
OpenAI gpt-oss-120b 與 gpt-oss-20b 發布
OpenAI 已發布 gpt-oss-120b 與 gpt-oss-20b,這兩款在 Apache 2.0 授權下的開放權重推理模型,旨在支援代理式工作流程與可自訂的推理努力。
OpenAI gpt-oss 發行說明
OpenAI 已發布 gpt-oss-120b 與 gpt-oss-20b,兩款在 Apache 2.0 授權下的開放權重推理模型,提供前沿級的推理與工具使用能力,且針對消費者硬體進行了最佳化。
OpenAI 開放權重發布
OpenAI 已發布其最強大的開放權重推理模型,以民主化 AI 存取並在全球推廣美國主導的民主 AI 標準。
Anthropic 透過 GSA Schedule 為美國聯邦機構提供 Claude
Anthropic 已透過美國總務署 (GSA) schedule 提供 Claude 供購買,簡化了美國聯邦政府部門與機構的採購流程。
OpenAI gpt-oss 在 Ollama 上發佈
Ollama 與 OpenAI 合作整合了 gpt-oss 開放權重模型,提供 20B 與 120B 參數版本,並透過 MXFP4 量化格式針對本地執行進行了優化。
Claude Opus 4.1 發佈說明
Anthropic 已發佈 Claude Opus 4.1,這是 Claude Opus 4 的升級版本,旨在提升在代理任務、現實世界編碼以及推理方面的性能。
NVIDIA AI-Q 藍圖:DeepResearch Bench 上排名第一的開源深度研究代理
NVIDIA 的 AI-Q 藍圖在 Hugging Face DeepResearch Bench 上的開源授權堆疊中取得第一名,結合了 Llama 3.3-70B Instruct 與 Llama-3.3-Nemotron-Super-49B-v1.5。
Qwen-Image 發布:原生文字渲染與精準影像編輯
Qwen-Image 是一個 20 億參數的 MMDiT 影像基礎模型,提供最先進的複雜文字渲染與精準影像編輯功能。
OpenAI 優化 ChatGPT 以提升使用者效用與福祉
OpenAI 正將 ChatGPT 的優化目標從停留時間等參與指標,轉向實際效用與使用者福祉,並加入休息提醒以及對高風險個人決策的改進處理。
Anthropic 安全且值得信賴的 AI Agent 框架
Anthropic 推出了一個以人類控制、透明度、價值對齊、隱私和安全性為核心的負責任 agent 開發早期框架,以確保自主 AI agent 仍能保持安全且可靠。
3LM:阿拉伯語大型語言模型在 STEM 與程式碼領域的基準測試
Hugging Face 與阿聯酋 TII 推出 3LM,這是首個全面的基準測試,旨在評估阿拉伯語大型語言模型在 STEM 科目與程式碼生成方面的表現。
為衛星影像分類進行 Pixtral-12B 微調
Mistral AI 證明了使用 LoRA 在航空影像數據集 (AID) 上對 Pixtral-12B 進行微調,能將分類準確度從 0.56 提高到 0.91,同時將幻覺率從 5% 降低到 0.1%。
Figma AI 整合與產品演進
Figma 正在於其平台全面整合 AI,以自動化例行設計任務,並透過 Figma Make 引入提示即應用的功能,將設計師的角色從執行轉變為高層次的問題解決。
Anthropic 用於監控與控制 AI 性格特質的人格向量
Anthropic 引入了人格向量,這是一種神經網路活動模式,允許開發者在語言模型中監控、防止並減輕如奉承和幻覺等不理想的性格特質。
使用 Gradio 在 Python 中實作 MCP 伺服器
Hugging Face 介紹了一種讓 Python 開發者快速使用 Gradio 建立 Model Context Protocol(MCP)伺服器的方法,使 LLM 能夠整合 Hugging Face Hub 上數千個 AI 模型與 Spaces。
OpenAI 推出 Stargate Norway AI 數據中心
OpenAI 已在挪威納爾維克推出 Stargate Norway,這是一項以可再生能源驅動的 AI 數據中心計畫,目標在 2026 年底前交付 100,000 顆 NVIDIA GPU。
Mistral AI Codestral 25.08 與企業級編碼堆疊發佈
Mistral AI 發佈了 Codestral 25.08 以及一套全面的企業級編碼堆疊,其特色是整合了補全、語義搜尋與代理工作流,並提供靈活的部署選項。
Intercom 的永續 AI 優勢策略
Intercom 透過優先提升早期模型流暢度、嚴謹的評估框架,以及允許快速模型切換與成本最佳化的模組化架構,取得了永續的 AI 優勢。
Anthropic 加入 CMS 健康科技生態系統承諾,促進醫療保健互通性
Anthropic 已簽署美國醫療保險和醫療補助服務中心 (CMS) 的健康科技生態系統承諾,旨在利用 AI 現代化醫療數據共享並消除數據孤島。
Ollama App Release for macOS and Windows
Ollama 已針對 macOS 和 Windows 推出全新應用程式,提供圖形使用者介面以進行本地 AI 模型下載與對話,並支援檔案上傳與多模態功能。
ChatGPT 學習模式發布
OpenAI 在 ChatGPT 中推出了學習模式,這是一種學習體驗,旨在透過蘇格拉底式提問與階梯式回應,引導學生解決問題,而非直接給予答案。
Hugging Face Trackio 發布
Hugging Face 已發布 Trackio,一個免費、開源、輕量級的實驗追蹤庫,可作為 wandb 的即插即用替代方案,並原生整合 Hugging Face Spaces 與 Datasets。
Qwen GSPO:可擴展的語言模型強化學習
Qwen 推出群組序列策略優化(GSPO),這是一種序列級別的 RL 演算法,較 GRPO 在訓練穩定性與效率上有顯著提升,尤其適用於 Mixture-of-Experts(MoE)模型。
Hugging Face CLI 更新:轉換至 hf 指令
Hugging Face 已將 huggingface-cli 改名為 hf,推出更符合人體工學的資源-動作指令結構,並新增 hf jobs 服務以在 HF 基礎設施上執行腳本。
Parquet 內容定義分塊以提升資料去重效率
Hugging Face 推出 Parquet 內容定義分塊(CDC),現已在 PyArrow 與 Pandas 中提供,使得在 Xet 儲存層上對 Parquet 檔案進行高效去重成為可能,顯著縮短上傳與下載時間。
Qwen-MT Turbo 發行說明
Qwen 已發布 Qwen-MT(qwen-mt-turbo),這是一款基於輕量化 MoE 的翻譯模型,支援 92 種語言,具備高度可客製化且 API 成本低廉。
Outtake 網路安全代理 由 OpenAI 提供動力
Outtake 使用 GPT-4.1 與 OpenAI o3 自動化偵測與解決數位威脅,將下架時間從 60 天縮短至數小時。
使用 Diffusers 與 PEFT 的 Flux 快速 LoRA 推理
Hugging Face 推出針對 Flux.1-Dev 的最佳化配方,透過結合熱切換、torch.compile 與 FP8 量化,使 LoRA 推理速度提升最高可達 2.23 倍。
TimeScope:長影片大型多模態模型理解的新基準
Hugging Face 推出 TimeScope,一個開源基準,透過在長度從 1 分鐘到 8 小時的內容中插入影片針頭,評估視覺語言模型的時間理解能力。
OpenAI DevDay 2025 公告
OpenAI 將於 2025 年 10 月 6 日在舊金山舉辦第三屆年度 DevDay,分享新發展並與超過 1,500 名開發者交流。
Model ML 金融服務的 AI 基礎設施
Model ML 正在利用 OpenAI 的最新模型和 Agent SDK,為金融機構提供專為其打造的 AI 代理人以及端到端工作流程自動化。
Anthropic 對美國 AI 行動計畫的回應
Anthropic 支持白宮的 AI 行動計畫,因其重視基礎設施和聯邦採用,但敦促建立更強大的國家透明度標準,並對中國實施更嚴格的 H20 晶片出口管制。
Anthropic 與芝加哥大學 BFI 的 AI 經濟研究合作夥伴關係
Anthropic 已與芝加哥大學的 Becker Friedman Institute for Economics (BFI) 建立合作夥伴關係,利用 Claude for Enterprise 和 Anthropic Economic Index 來研究 AI 對勞動力市場和經濟的影響。
Mistral AI 環境影響研究與擬議全球標準
Mistral AI 進行了首個此類型的 LLM 全面生命週期分析,披露了 Mistral Large 2 的特定碳、水和資源枯竭指標,以倡導全球環境報告標準。
Qwen3-Coder 發行說明
Qwen 已發布 Qwen3-Coder,一款 Mixture-of-Experts 模型,在代理程式編寫、瀏覽器使用與工具使用方面達到最先進的開源模型表現,與 Claude Sonnet 4 相當。
OpenAI 與 Penda Health AI 臨床副駕駛研究
OpenAI 與 Penda Health 開發了 AI Consult,一款由大型語言模型驅動的副駕駛,在肯亞奈洛比近 40,000 次患者就診中,使診斷錯誤降低了 16%,治療錯誤降低了 13%。
OpenAI 與 Oracle 合作擴展 Stargate AI 基礎設施 4.5 GW
OpenAI 與 Oracle 合作在美國開發額外 4.5 吉瓦的 Stargate 數據中心容量,使 OpenAI 正在建設的總容量超過 5 吉瓦。
OpenAI 經濟分析與生產力研究倡議
OpenAI 發布了首份關於 ChatGPT 生產力提升的經濟分析,並啟動了一項為期 12 個月的研究合作,以評估 AI 對勞動力的影響。
NVIDIA NIM 與 Hugging Face 的整合
NVIDIA 已將 NVIDIA NIM 擴展至支援超過 100,000 個 Hugging Face 上的 LLM,提供單一 Docker 容器,自動化模型分析、後端選擇與效能最佳化,以快速部署。
OpenAI 與英國政府的 AI 驅動增長戰略夥伴關係
OpenAI 與英國政府已簽署備忘錄,以加速公共與私營部門的 AI 採用,並在英國擴大 AI 基礎建設。
OpenAI 應用程式執行長公告:AI 作為全球賦能的工具
OpenAI 任命了新的應用程式執行長,領導推動 AI 驅動的知識、醫療、經濟自由與個人支援的民主化取得。
Anthropic 將簽署歐盟通用型 AI 實務守則
Anthropic 已宣布其打算簽署歐盟通用型 AI 實務守則,以推進前沿 AI 開發中的透明度、安全性與問責制。
Anthropic Build AI in America Energy Report
Anthropic 提議了一個戰略框架,旨在於 2028 年前確保 50GW 的電力容量,以維持美國 AI 領導地位並與中國快速擴張的能源基礎設施競爭。
OpenAI 為非營利與社區組織推出 $50 百萬基金
OpenAI 已設立一個初始 $50 百萬基金,直接支援非營利與社區組織,利用 AI 為公共利益服務,涵蓋醫療保健、教育與經濟機會等領域。
Arc 虛擬細胞挑戰簡介
Arc 虛擬細胞挑戰要求參賽者訓練模型,以預測透過 CRISPR 靜默基因對細胞轉錄組的影響,使用包含 30 萬筆單細胞 RNA 定序資料的資料集。
Mistral AI Le Chat 更新 2025 年 7 月
Mistral AI 更新了 Le Chat,新增了 Deep Research、透過 Voxtral 提供的語音能力、透過 Magistral 提供的多語言推理、用於組織管理的 Projects,以及進階影像編輯功能。