✷ 封存 · 11 個實驗室 · 116 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
TITLE: Google DeepMind 與韓國的合作
SUMMARY: Google DeepMind 已與韓國科學與資訊通訊部合作,在首爾設立 AI 校園並部署前沿 AI 模型,以加速生命科學、能源與氣候領域的科學研究。
# Google DeepMind 解耦 DiLoCo
Google DeepMind 推出了解耦 DiLoCo,一種分散式訓練架構,能夠在低頻寬且使用混合硬體世代的情況下,實現跨遙遠資料中心的彈性、非同步 LLM 訓練。
Google DeepMind 與 Accenture、Bain & Company、BCG、Deloitte 以及 McKinsey 合作,加速 AI 轉型
Google DeepMind 宣佈與 Accenture、Bain & Company、BCG、Deloitte 以及 McKinsey 建立合作夥伴關係,透過提供 Gemini 等前沿模型的早期存取、共同開發產業特定 AI 解決方案,並將領導層與客戶的執行長連結,以加速企業 AI 轉型。
Gemini 3.1 Flash TTS 發佈說明 / 新功能
Google DeepMind 已發佈 Gemini 3.1 Flash TTS,這是一款具備自然語言音訊標籤的文字轉語音模型,可針對 70 多種語言的語音風格、節奏和表達方式進行精確控制。
Gemini Robotics-ER 1.6 版本說明 / 新功能
Google DeepMind 已發布 Gemini Robotics-ER 1.6,一款以推理為先的模型,提升了空間推理、多視角理解以及儀表讀取能力,以支援自主機器人任務。
Gemma 4 發布說明:高智慧開放模型,用於推理與代理
Google DeepMind 已發布 Gemma 4,這是一個在 Apache 2.0 許可下的開放模型家族,旨在支援高階推理、代理工作流程,以及高效的裝置端部署。
Google DeepMind AI 啟用指標
Google DeepMind 正在開發一款由 Gemini 驅動的 AI 啟用指標,該指標以直觀的指向與語音指令取代複雜的文字提示,讓使用者能在各種應用程式中與數位內容互動。
Gemini 3.1 Flash Live 版本說明 / 新功能概覽
Google DeepMind 已推出 Gemini 3.1 Flash Live,一款高品質的音訊與語音模型,旨在提供自然即時的對話,具備更高精準度、降低延遲,且全球可用性擴大。
Google DeepMind 關於 AI 有害操控的研究
Google DeepMind 發布了一項新的研究報告與一套經實證驗證的工具組,用以衡量並降低 AI 被用於有害操控人類思想與行為的風險。
Lyria 3 Pro 發布:更長、具結構感知的音樂生成,遍及 Google 產品
DeepMind 宣布了 Lyria 3 Pro,一款能夠創建長達三分鐘、具結構感知的音樂生成模型,現已整合至 Google 產品,包括 Vertex AI、AI Studio、Google Vids、Gemini 與 ProducerAI。
Google DeepMind 測量通往 AGI 的進展:認知框架
Google DeepMind 已推出認知分類法與三階段評估協議,以實證方式衡量 AI 向人工通用智慧(AGI)的進展。
Google DeepMind:AlphaGo 十 年的影響
Google DeepMind 回顧 AlphaGo 於 2016 年擊敗世界冠軍的勝利,如何催化了科學、數學領域以及通往通用人工智慧(AGI)之路的十年 AI 突破。
Gemini 3.1 Flash‑Lite 發布:快速、低成本的高容量工作負載 AI
Google DeepMind 推出 Gemini 3.1 Flash‑Lite,一款針對高容量工作負載的快速、成本效益 AI 模型,價格為每百萬輸入 token $0.25、每百萬輸出 token $1.50。
Nano Banana 2 發布:以 Flash 速度的專業級圖像生成
Google DeepMind 宣布 Nano Banana 2,這是一款結合 Nano Banana Pro 先進功能與 Gemini Flash 超低延遲的圖像生成模型,能即時在 Google 產品中提供高品質、以知識為基礎的圖像。
Gemini 3.1 Pro 版本說明
Google DeepMind 推出 Gemini 3.1 Pro,一款在複雜任務上推理能力大幅提升的新模型,現已透過 Gemini API、Vertex AI、Gemini 應用程式與 Notebook LM 提供預覽版。
Gemini 音樂生成與 Lyria 3
Google DeepMind 已將 Lyria 3 生成式音樂模型整合至 Gemini 應用程式,使用者可透過文字提示或圖像與影片上傳,創作 30 秒的 AI 生成音軌。
Google DeepMind AI 國家夥伴關係:印度擴展
Google DeepMind 正在與印度政府機構及院校建立新夥伴關係,以擴大科學、教育、農業與能源安全領域前沿 AI 模型的使用機會。
Gemini 3 Deep Think 更新
Google DeepMind 已更新 Gemini 3 Deep Think,這是一種在數學、物理與化學奧林匹克中達到金牌等級表現的專門推理模式,且現已透過 Gemini API 向特定使用者開放。
Gemini Deep Think 讓自主研究遍及數學、物理與電腦科學
Gemini Deep Think 為自主與協作型代理人提供動力,使其能解決研究層級的數學、物理與電腦科學問題,產出可發表的成果並解決未解的猜想。
Project Genie:Google DeepMind 的互動世界模型原型
Google DeepMind 推出了 Project Genie,這是一個由 Genie 3 驅動的實驗性研究原型,使用戶能夠創建、探索與重新混搭互動式即時生成的環境。
D4RT:動態 4D 重建與追蹤
Google DeepMind 推出 D4RT,一個統一的 AI 模型,用於 4D 場景重建與追蹤,其效率比以往方法提升最高可達 300 倍。
Veo 3.1 發行說明:增強的 Ingredients to Video 與 4K 升級
Google DeepMind 已發布 Veo 3.1,推出改進的身分與物件一致性以支援影像轉影片生成、原生直向影片支援,以及升級至 1080p 與 4K 解析度。
Google DeepMind 2025 年度回顧:Gemini 3、Gemma、AI 產品、科學與安全突破
Google DeepMind 宣布了 2025 年的突破,涵蓋 Gemini 3 模型、開源 Gemma、AI 驅動產品、生成式媒體、科學 AI、量子運算、安全框架及全球協作,標誌著 AI 從工具向公用事業的轉型。
Gemini 3 Flash 版本說明 / 新功能
Google DeepMind 已發布 Gemini 3 Flash,這是一種結合前沿級推理與多模態智能、具備低延遲並降低開發者與消費者成本的模型。
Gemma Scope 2 發佈 – 用於解讀 Gemma 3 語言模型的開源工具
Gemma Scope 2 是一套針對 Gemma 3 模型(270M‑27B 參數)的開源可解釋性工具,讓研究人員能追蹤內部計算並除錯安全關鍵行為。
Gemini 2.5 Flash Native Audio 發布:增強即時語音代理與即時語音翻譯
Google DeepMind 宣布推出 Gemini 2.5 Flash Native Audio,這是一個即時語音模型,提升了函式呼叫、指令遵循以及多輪對話能力,並新增支援超過 70 種語言的即時語音對語音翻譯。
Google DeepMind 與英國 AI 安全研究所擴展合作伙伴關係
Google DeepMind 透過一份新的諒解備忘錄,將其與英國 AI 安全研究所 (AISI) 的合作擴展至專注於基礎安全與安全研究。
Google DeepMind 與英國政府合作夥伴關係公告
Google DeepMind 正深化與英國政府的合作,以加速 AI 在科學、教育、公共服務及國家安全領域的整合。
Google DeepMind FACTS 基準套件發布
Google DeepMind 已推出 FACTS 基準套件,一套旨在系統性評估並提升大型語言模型在參數知識、搜尋工具使用、多模態輸入和基礎情境方面事實性的四個基準的綜合集合。
使用 AlphaFold 工程耐熱作物
密西根州立大學的研究人員使用 AlphaFold 工程了一種混合甘油酸激酶酶,該酶在高達 65°C 的溫度下仍保持穩定,為創造更具韌性的糧食作物提供了藍圖。
AlphaFold: 五年科學影響
Google DeepMind 的 AlphaFold 透過解決 50 年來的蛋白質結構預測問題,改變了生物學研究,使超過 300 萬名研究人員能夠加速藥物發現與疾病理解。
Google DeepMind: 揭示 apoB100 蛋白質的結構
研究人員使用 AlphaFold 和冷凍電子顯微鏡繪製了 apoB100 的結構,apoB100 是『壞膽固醇』(LDL)的蛋白質支架,這可能使得心血管疾病的治療更加精準。
Google DeepMind 與美國能源部合作推動 Genesis 任務
Google DeepMind 為美國能源部的 17 個國家實驗室提供加速存取前沿 AI 模型與代理工具,以加速能源、國家安全與生醫研究領域的科學發現。
Google Gemini AI 圖像驗證
Google 正將 SynthID 浮水印技術整合到 Gemini 應用程式中,以允許使用者驗證圖像是否由 Google AI 生成或編輯。
Nano Banana Pro (Gemini 3 Pro Image) 發佈
Google DeepMind 已發佈 Nano Banana Pro (Gemini 3 Pro Image),這是一款專為工作室級別輸出與進階創意控制而設計的高保真度圖像生成與編輯模型。
Nano Banana Pro 版本說明
Google DeepMind 已推出 Nano Banana Pro(Gemini 3 Pro Image),一種建基於 Gemini 3 Pro 的最先進圖像生成與編輯模型,具備增強的推理能力、改進的文字渲染以及專業級的創意控制。
Gemini 3 Pro 版本說明
Google DeepMind 已發布 Gemini 3 Pro,該模型具備先進的推理能力、具代理能力的編程功能以及最先進的多模態理解,適用於複雜的視覺和視頻推理。
Google DeepMind 在新加坡擴展影響力
Google DeepMind 正在新加坡開設一個新的研究實驗室,以推動亞太地區的前沿 AI 研究與應用。
Gemini 3 版本說明
Google DeepMind 已發布 Gemini 3,這是一個具備先進推理、具代理能力的編程功能以及全新 Deep Think 模式以解決複雜問題的最先進多模態模型。
Google Antigravity: 代理開發平台發布
Google DeepMind 已推出 Google Antigravity,這是一個以代理為先的開發平台,使 AI 代理能夠在 IDE、終端機和瀏覽器之間自主規劃並執行複雜的軟體任務。
WeatherNext 2 版本說明 / 新功能
Google DeepMind 已發布 WeatherNext 2,這是一個 AI 天氣預報模型,能夠以比先前版本快 8 倍的速度生成預報,解析度可達 1 小時,且在 99.9% 的變數上準確度有所提升。
SIMA 2:一個在虛擬 3D 世界中與你一起玩耍、推理與學習的代理人
Google DeepMind 推出了 SIMA 2,一個結合 Gemini 模型的通用 AI 代理人,從簡單的指令遵循進階到在虛擬 3D 環境中進行推理、對話與自我改進。
Google DeepMind 視覺對齊研究
Google DeepMind 已開發出一種三步對齊方法,重新組織 AI 視覺表示以匹配人類概念階層,提升模型穩健性與泛化能力。
Google DeepMind Gemini AI 在北愛爾蘭學校的試點計畫
北愛爾蘭涉及 100 位教師使用 Gemini 和 Google Workspace 工具的六個月試點計畫,使每位教師每週平均節省 10 小時。
Google DeepMind 運用 AI 進行自然的映射、建模與理解
Google DeepMind 已宣布新的 AI 研究與工具,用於預測森林砍伐風險、大規模映射物種分布,以及透過 Perch 2.0 生物聲學模型識別動物發聲。
Google DeepMind AI 數學計畫
Google DeepMind 與 Google.org 已啟動 AI for Math Initiative,該計畫與五個享有聲譽的研究機構合作,利用如 Gemini Deep Think、AlphaEvolve 和 AlphaProof 等 AI 工具加速數學發現。
T5Gemma: 透過僅解碼器適應的編碼器-解碼器 LLM
Google DeepMind 推出 T5Gemma,一系列透過適應預訓練的僅解碼器 Gemma 2 模型而建立的編碼器-解碼器模型,以提升推理效率和推理性能。
MedGemma 與 MedSigLIP 發布說明
Google DeepMind 已發布 MedGemma 與 MedSigLIP,這是一系列開放的多模態模型,旨在為醫療與生命科學 AI 開發提供高效能且保護隱私的基礎。
Gemma 3n 版本說明 / 新功能
Google DeepMind 已發布 Gemma 3n,這是一個以行動為優先的多模態模型系列,具備巢狀 MatFormer 架構,可實現彈性推理並在邊緣設備上達到高效能。
Gemini 2.5 Flash-Lite 版本說明
Google DeepMind 已發布 Gemini 2.5 Flash-Lite 的穩定版本,這是 Gemini 2.5 系列中最快且最具成本效益的模型,擁有 100 萬個 token 的上下文視窗和原生推理能力。