Nano Banana 2 发布:专业级图像生成,闪电速度
Google DeepMind 宣布了 Nano Banana 2,这是一款将 Nano Banana Pro 的高级功能与 Gemini Flash 的超低延迟相结合的图像生成模型,能够即时为 Google 产品提供高质量、基于知识的图像。
Gemini 3.1 Pro 发布说明
Google DeepMind 推出了 Gemini 3.1 Pro,这是一款在复杂任务上推理能力显著提升的新模型,现已通过 Gemini API、Vertex AI、Gemini 应用和 Notebook LM 以预览形式提供。
使用 Lyria 3 的 Gemini 音乐生成
Google DeepMind 已将 Lyria 3 生成音乐模型集成到 Gemini 应用中,使用户能够通过文本提示或图像、视频上传创建 30 秒的 AI 生成曲目。
Google DeepMind 人工智能国家合作伙伴计划:印度扩展
Google DeepMind 正在与印度政府部门和机构建立新的合作伙伴关系,以扩大前沿 AI 模型在科学、教育、农业和能源安全方面的获取。
Gemini 3 Deep Think 更新
Google DeepMind 已更新 Gemini 3 Deep Think,这是一种专门的推理模式,在数学、物理和化学奥林匹克中达到金牌水平表现,并已通过 Gemini API 向特定用户开放。
Gemini Deep Think 实现跨数学、物理和计算机科学的自主研究
Gemini Deep Think 为自主和协作代理提供动力,解决研究级别的数学、物理和计算机科学问题,产出可发表的成果并破解未解猜想。
Project Genie:Google DeepMind 的交互式世界模型原型
Google DeepMind 推出了 Project Genie,这是一款由 Genie 3 驱动的实验性研究原型,允许用户创建、探索并重新混合交互式实时生成的环境。
Veo 3.1 发布说明:增强的原料到视频功能与 4K 升级
Google DeepMind 发布了 Veo 3.1,引入了改进的身份和对象一致性用于图像到视频的生成、原生竖屏视频支持以及 1080p 和 4K 分辨率的升级。
Google DeepMind 2025 年度回顾:Gemini 3、Gemma、AI 产品、科学与安全突破
Google DeepMind 宣布了 2025 年在 Gemini 3 模型、开源 Gemma、AI 驱动的产品、生成式媒体、科学 AI、量子计算、安全框架以及全球合作方面的突破,标志着 AI 从工具向实用性的转变。
Gemini 3 Flash 发行说明 / 新功能
Google DeepMind 已发布 Gemini 3 Flash,这是一种将前沿级推理和多模态智能与低延迟和降低成本相结合的模型,面向开发者和消费者。
Gemma Scope 2 发布 – 用于解释 Gemma 3 语言模型的开源工具
Gemma Scope 2 是一套针对 Gemma 3 模型(270M‑27B 参数)的开源可解释性工具,能够让研究人员追踪内部计算并调试安全关键行为。
Gemini 2.5 Flash Native Audio 发布:增强型实时语音代理与实时语音翻译
Google DeepMind 发布了 Gemini 2.5 Flash Native Audio,这是一款实时语音模型,改进了函数调用、指令遵循和多轮对话,同时增加了支持 70 多种语言的实时语音到语音翻译功能。
Google DeepMind 与英国 AI 安全研究所扩大合作伙伴关系
Google DeepMind 通过签署一份专注于基础安全与安全性研究的新谅解备忘录,扩大了与英国 AI 安全研究所 (AISI) 的合作伙伴关系。
Google DeepMind与英国政府合作伙伴关系公告
谷歌DeepMind正在加深与英国政府的合作,以加速AI在科学、教育、公共服务和国家安全领域的集成。
Google DeepMind FACTS 基准套件发布
Google DeepMind 推出了 FACTS 基准套件,这是一套旨在系统评估和提升大型语言模型在参数知识、搜索工具使用、多模态输入和基础上下文方面事实性的四个基准的综合集合。
使用 AlphaFold 工程化耐热作物
密歇根州立大学的研究人员使用 AlphaFold 工程化了一种在高达 65°C 下仍保持稳定的甘油酸激酶混合酶,为创建更具韧性的食物作物提供了蓝图。
AlphaFold: 五年科学影响
Google DeepMind 的 AlphaFold 通过解决这一 50 年的蛋白质结构预测问题,彻底改变了生物学研究,使超过 300 万名研究者能够加速药物发现和疾病理解。
Google DeepMind: 揭示apoB100蛋白质的结构
研究人员使用AlphaFold和冷冻电子显微镜绘制了apoB100的结构,apoB100是'坏胆固醇'(LDL)的蛋白质支架,这可能使得心血管疾病的治疗更加精准。
Google DeepMind与美国能源部合作开展Genesis Mission
Google DeepMind正在为美国能源部的17个国家实验室提供前沿AI模型和代理工具的加速访问,以加速能源、国家安全和生物医学研究领域的科学发现。
Google Gemini AI 图像验证
Google 正在将 SynthID 水印技术集成到 Gemini 应用中,以允许用户验证图像是否由 Google AI 生成或编辑。
Nano Banana Pro 发布说明
Google DeepMind 推出了 Nano Banana Pro(Gemini 3 Pro Image),这是一种基于 Gemini 3 Pro 构建的最先进的图像生成和编辑模型,具备增强的推理能力、改进的文本渲染以及专业级的创意控制。
Gemini 3 Pro 发布说明
Google DeepMind 已发布 Gemini 3 Pro,这是一个具有高级推理、智能体编码能力以及最先进的多模态理解的模型,用于复杂的视觉和视频推理。
Google DeepMind 扩大在新加坡的影响力
Google DeepMind 正在新加坡开设一个新的研究实验室,以推动亚太地区的前沿 AI 研究和应用。
Gemini 3 发布说明
Google DeepMind 已发布 Gemini 3,这是一种具有先进推理、智能体编码能力以及全新 Deep Think 模式以解决复杂问题的最先进多模态模型。
Google Antigravity: 智能体开发平台发布
Google DeepMind 已推出 Google Antigravity,这是一个以智能体为先的开发平台,使 AI 能够在 IDE、终端和浏览器之间自主规划和执行复杂的软件任务。
WeatherNext 2 发布说明 / 新功能
Google DeepMind 已发布 WeatherNext 2,这是一个 AI 天气预报模型,相比之前的版本生成预报速度快 8 倍,分辨率可达 1 小时,并且在 99.9% 的变量上准确性得到提升。
SIMA 2: 一个在虚拟 3D 世界中与你一起玩耍、推理和学习的代理
Google DeepMind 推出了 SIMA 2,这是一个通用型 AI 代理,集成了 Gemini 模型,使其能够超越简单的指令跟随,在虚拟 3D 环境中进行推理、对话和自我改进。
Google DeepMind 视觉对齐研究
谷歌DeepMind开发了一种三步对齐方法,重组AI视觉表示以匹配人类概念层次,提高模型鲁棒性和泛化能力。
Google DeepMind Gemini AI 在北爱尔兰学校的试点
北爱尔兰涉及100名教师使用Gemini和Google Workspace工具的六个月试点项目使每位教师平均每周节省10小时。
Google DeepMind 使用 AI 进行映射、建模和理解自然
Google DeepMind 宣布了新的 AI 研究和工具,用于预测森林砍伐风险、大规模映射物种分布,以及通过 Perch 2.0 生物声学模型识别动物叫声。
Google DeepMind AI for 数学 倡议
Google DeepMind 和 Google.org 启动了 AI for 数学 倡议,这是一个与五家享有盛誉的研究机构合作的项目,旨在使用如 Gemini Deep Think、AlphaEvolve 和 AlphaProof 等 AI 工具加速数学发现。
T5Gemma: 通过 Decoder-Only 适配实现 Encoder-Decoder LLMs
Google DeepMind 推出了 T5Gemma,这是一系列通过适配预训练的 decoder-only Gemma 2 模型而创建的 encoder-decoder 模型,旨在提高推理效率和推理性能。
MedGemma 和 MedSigLIP 发布说明
Google DeepMind 发布了 MedGemma 和 MedSigLIP,这是一系列开放的多模态模型,旨在为医疗和生命科学 AI 开发提供高性能且保护隐私的基础。
Gemma 3n 发布说明 / 新功能
Google DeepMind 已发布 Gemma 3n,这是一款面向移动端的多模态模型系列,采用嵌套的 MatFormer 架构,实现弹性推理并在边缘设备上提供高性能。
Gemini 2.5 Flash-Lite 发布说明
Google DeepMind 已发布 Gemini 2.5 Flash-Lite 的稳定版,这是 Gemini 2.5 系列中最快且最具成本效益的模型,具有 100 万令牌上下文窗口和原生推理能力。
Google DeepMind Veo:将生成视频融入现场实拍电影制作《ANCESTRA》
Google DeepMind 与导演 Eliza McNitt 以及 Darren Aronofsky 创立的 Primordial Soup 合作制作短片《ANCESTRA》,展示了 Veo 如何通过个性化生成和运动匹配,将生成视频与现场实拍画面融合。
AlphaEarth Foundations:统一的地理空间嵌入用于全球制图
Google DeepMind 推出了 AlphaEarth Foundations,这是一款将数拍字节的多模态地球观测数据整合为统一数字嵌入的 AI 模型,旨在革新全球制图和环境监测。
DeepMind Backstory 实验性图像来源与可信度工具
Google DeepMind 宣布推出 Backstory,这是一款实验性的 AI 工具,使用 Gemini 模型揭示图像的 AI 生成状态、来源、修改以及不断演变的上下文,帮助用户评估其可信度。
Gemini Deep Think 在 IMO 2025 中达到金牌标准
Gemini 的高级 Deep Think 版本在国际数学奥林匹克中解答了六道题中的五道,获得 35 分,达到了金牌标准。
Google DeepMind Aeneas:用于古代铭文情境化的 AI
Google DeepMind 推出了 Aeneas,这是首个旨在帮助历史学家通过多模态分析和并行文本检索来解释、归属和修复零碎拉丁铭文的 AI 模型。
Genie 3 实时世界模型发布
Genie 3 是 DeepMind 的新实时世界模型,能够以 24 fps 生成交互式 720p 环境,并在数分钟内保持一致性,支持先进的具身代理研究。
Google DeepMind Perch 更新:推动濒危物种的生物声学研究
Google DeepMind 发布了更新的开源 Perch 模型,提升了鸟类物种预测能力,并将生物声学分析扩展到哺乳动物、两栖动物以及珊瑚礁等水下环境。
Google DeepMind 深度环形整形用于 LIGO 引力波天文台
Google DeepMind 推出了 Deep Loop Shaping,这是一种 AI 方法,可将 LIGO 反馈系统中的控制噪声降低 30 到 100 倍,从而实现更精确的引力波探测。
Gemini 2.5 Deep Think ICPC 世界总决赛表现
Gemini 2.5 Deep Think 的高级版本在2025年国际大学生程序设计竞赛(ICPC)世界总决赛中实现了金牌水平的表现,解决了12道复杂算法题中的10道。
Google DeepMind 使用 AI 发现新的流体动力学奇点
Google DeepMind 开发了一种基于物理信息神经网络(PINNs)的新型 AI 方法,能够在流体动力学方程中发现新的不稳定奇点族,为解决长期存在的数学难题提供了新路径。
Google DeepMind 前沿安全框架更新
Google DeepMind 发布了其前沿安全框架(FSF)的第三版,引入了针对有害操纵和错位 AI 的新风险领域,并新增了可追踪能力层级(TCL),以实现更早的风险检测。
Gemini Robotics 1.5 与 Gemini Robotics-ER 1.5 发布
Google DeepMind 推出了 Gemini Robotics 1.5 和 Gemini Robotics-ER 1.5,这两款模型将高层具身推理与直接的视觉语言动作控制相结合,使机器人能够执行复杂的多步骤物理任务。
Google DeepMind CodeMender AI 代码安全代理
Google DeepMind 推出了 CodeMender,这是一款 AI 驱动的代理,能够自动识别、修补并主动保护开源项目中的软件漏洞。
Google DeepMind 与 Commonwealth Fusion Systems 的聚变能源合作伙伴关系
Google DeepMind 正与 Commonwealth Fusion Systems 合作,利用 AI、强化学习和 TORAX 模拟器,加速在 SPARC 托卡马克中实现净聚变能量的进程。
Gemini 2.5 深度思考发布
Google DeepMind 已在 Gemini 应用中为 Google AI Ultra 订阅者推出 Deep Think,引入并行思考技术,以提升在编码、科学和数学等复杂问题求解中的能力。