归档 · 11 个实验室 · 116 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

51

Google DeepMind 与大韩民国的合作伙伴关系

Google DeepMind 已与韩国科学技术信息通信部达成合作,在首尔建立一个 AI Campus,并部署前沿 AI 模型,以加速生命科学、能源和气候领域的科学研究。

52

Google DeepMind 去耦合 DiLoCo

Google DeepMind 推出了去耦合 DiLoCo,这是一种分布式训练架构,能够在远程数据中心使用低带宽和混合不同代的硬件实现具有韧性的异步 LLM 训练。

53

Google DeepMind 与 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey 合作,加速 AI 转型

Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey 建立合作伙伴关系,通过提供对 Gemini 等前沿模型的早期访问、共同开发行业特定的 AI 解决方案,以及将领导层与客户 CEO 对接,以加速企业 AI 转型。

54

Gemini 3.1 Flash TTS 发行说明 / 新功能

Google DeepMind 发布了 Gemini 3.1 Flash TTS,这是一种具有自然语言音频标签的文本转语音模型,可在 70+ 种语言中精确控制语音风格、节奏和表达。

55

Gemini Robotics-ER 1.6 发布说明 / 新功能

Google DeepMind 发布了 Gemini Robotics-ER 1.6,这是一款以推理为先的模型,提升了空间推理、多视角理解以及仪表读取能力,以支持自主机器人任务。

56

Gemma 4 发布说明:用于推理和代理的高智能开源模型

Google DeepMind 已发布 Gemma 4,这是一系列在 Apache 2.0 许可证下的开源模型,旨在实现高级推理、代理工作流以及高效的设备端部署。

57

Google DeepMind AI 驱动的指针

Google DeepMind 正在开发一款由 Gemini 驱动的 AI 指针,它用直观的指向和语音指令取代复杂的文本提示,以在各类应用中与数字内容交互。

58

Gemini 3.1 Flash Live 发布说明 / 新功能

Google DeepMind 已发布 Gemini 3.1 Flash Live,这是一款高质量的音频和语音模型,旨在实现自然的实时对话,具备更高的精度、更低的延迟以及更广泛的全球可用性。

59

Google DeepMind 对 AI 有害操纵的研究

Google DeepMind 发布了一项新的研究报告和一个经实证验证的工具包,用于衡量并降低 AI 被用于有害操纵人类思想和行为的风险。

60

Lyria 3 Pro 发布:更长、更具结构感的音乐生成,遍及 Google 产品

DeepMind 宣布了 Lyria 3 Pro,这款音乐生成模型能够创作最长三分钟、具备结构感的曲目,并已在 Vertex AI、AI Studio、Google Vids、Gemini 和 ProducerAI 等 Google 产品中实现集成。

61

Google DeepMind 测量通往 AGI 的进展:认知框架

Google DeepMind 引入了认知分类法和三阶段评估协议,以实证方式衡量 AI 向通用人工智能(AGI)的进展。

62

Google DeepMind:AlphaGo 十年影响

Google DeepMind 回顾了 AlphaGo 2016 年对世界冠军的胜利如何催化了十年来在科学、数学以及人工通用智能(AGI)方面的 AI 突破。

63

Gemini 3.1 Flash‑Lite 发布:面向大批量工作负载的高速、低成本 AI

Google DeepMind 发布了 Gemini 3.1 Flash‑Lite,这是一款面向大批量工作负载的高速、低成本 AI 模型,输入代币每百万 0.25 美元,输出代币每百万 1.50 美元。

64

Nano Banana 2 发布:专业级图像生成,闪电速度

Google DeepMind 宣布了 Nano Banana 2,这是一款将 Nano Banana Pro 的高级功能与 Gemini Flash 的超低延迟相结合的图像生成模型,能够即时为 Google 产品提供高质量、基于知识的图像。

65

Gemini 3.1 Pro 发布说明

Google DeepMind 推出了 Gemini 3.1 Pro,这是一款在复杂任务上推理能力显著提升的新模型,现已通过 Gemini API、Vertex AI、Gemini 应用和 Notebook LM 以预览形式提供。

66

使用 Lyria 3 的 Gemini 音乐生成

Google DeepMind 已将 Lyria 3 生成音乐模型集成到 Gemini 应用中,使用户能够通过文本提示或图像、视频上传创建 30 秒的 AI 生成曲目。

67

Google DeepMind 人工智能国家合作伙伴计划:印度扩展

Google DeepMind 正在与印度政府部门和机构建立新的合作伙伴关系,以扩大前沿 AI 模型在科学、教育、农业和能源安全方面的获取。

68

Gemini 3 Deep Think 更新

Google DeepMind 已更新 Gemini 3 Deep Think,这是一种专门的推理模式,在数学、物理和化学奥林匹克中达到金牌水平表现,并已通过 Gemini API 向特定用户开放。

69

Gemini Deep Think 实现跨数学、物理和计算机科学的自主研究

Gemini Deep Think 为自主和协作代理提供动力,解决研究级别的数学、物理和计算机科学问题,产出可发表的成果并破解未解猜想。

70

Project Genie:Google DeepMind 的交互式世界模型原型

Google DeepMind 推出了 Project Genie,这是一款由 Genie 3 驱动的实验性研究原型,允许用户创建、探索并重新混合交互式实时生成的环境。

71

D4RT:动态4D重建与跟踪

Google DeepMind推出了D4RT,这是一个统一的AI模型,用于4D场景重建和跟踪,其效率比以往方法高出300倍。

72

Veo 3.1 发布说明:增强的原料到视频功能与 4K 升级

Google DeepMind 发布了 Veo 3.1,引入了改进的身份和对象一致性用于图像到视频的生成、原生竖屏视频支持以及 1080p 和 4K 分辨率的升级。

73

Google DeepMind 2025 年度回顾:Gemini 3、Gemma、AI 产品、科学与安全突破

Google DeepMind 宣布了 2025 年在 Gemini 3 模型、开源 Gemma、AI 驱动的产品、生成式媒体、科学 AI、量子计算、安全框架以及全球合作方面的突破,标志着 AI 从工具向实用性的转变。

74

Gemini 3 Flash 发行说明 / 新功能

Google DeepMind 已发布 Gemini 3 Flash,这是一种将前沿级推理和多模态智能与低延迟和降低成本相结合的模型,面向开发者和消费者。

75

Gemma Scope 2 发布 – 用于解释 Gemma 3 语言模型的开源工具

Gemma Scope 2 是一套针对 Gemma 3 模型(270M‑27B 参数)的开源可解释性工具,能够让研究人员追踪内部计算并调试安全关键行为。

76

Gemini 2.5 Flash Native Audio 发布:增强型实时语音代理与实时语音翻译

Google DeepMind 发布了 Gemini 2.5 Flash Native Audio,这是一款实时语音模型,改进了函数调用、指令遵循和多轮对话,同时增加了支持 70 多种语言的实时语音到语音翻译功能。

77

Google DeepMind 与英国 AI 安全研究所扩大合作伙伴关系

Google DeepMind 通过签署一份专注于基础安全与安全性研究的新谅解备忘录,扩大了与英国 AI 安全研究所 (AISI) 的合作伙伴关系。

78

Google DeepMind与英国政府合作伙伴关系公告

谷歌DeepMind正在加深与英国政府的合作,以加速AI在科学、教育、公共服务和国家安全领域的集成。

79

Google DeepMind FACTS 基准套件发布

Google DeepMind 推出了 FACTS 基准套件,这是一套旨在系统评估和提升大型语言模型在参数知识、搜索工具使用、多模态输入和基础上下文方面事实性的四个基准的综合集合。

80

使用 AlphaFold 工程化耐热作物

密歇根州立大学的研究人员使用 AlphaFold 工程化了一种在高达 65°C 下仍保持稳定的甘油酸激酶混合酶,为创建更具韧性的食物作物提供了蓝图。

81

AlphaFold: 五年科学影响

Google DeepMind 的 AlphaFold 通过解决这一 50 年的蛋白质结构预测问题,彻底改变了生物学研究,使超过 300 万名研究者能够加速药物发现和疾病理解。

82

Google DeepMind: 揭示apoB100蛋白质的结构

研究人员使用AlphaFold和冷冻电子显微镜绘制了apoB100的结构,apoB100是'坏胆固醇'(LDL)的蛋白质支架,这可能使得心血管疾病的治疗更加精准。

83

Google DeepMind与美国能源部合作开展Genesis Mission

Google DeepMind正在为美国能源部的17个国家实验室提供前沿AI模型和代理工具的加速访问,以加速能源、国家安全和生物医学研究领域的科学发现。

84

Google Gemini AI 图像验证

Google 正在将 SynthID 水印技术集成到 Gemini 应用中,以允许用户验证图像是否由 Google AI 生成或编辑。

85

Nano Banana Pro (Gemini 3 Pro Image) 发布

Google DeepMind 发布了 Nano Banana Pro (Gemini 3 Pro Image),这是一款专为工作室级别输出和先进创意控制而设计的高保真图像生成与编辑模型。

86

Nano Banana Pro 发布说明

Google DeepMind 推出了 Nano Banana Pro(Gemini 3 Pro Image),这是一种基于 Gemini 3 Pro 构建的最先进的图像生成和编辑模型,具备增强的推理能力、改进的文本渲染以及专业级的创意控制。

87

Gemini 3 Pro 发布说明

Google DeepMind 已发布 Gemini 3 Pro,这是一个具有高级推理、智能体编码能力以及最先进的多模态理解的模型,用于复杂的视觉和视频推理。

88

Google DeepMind 扩大在新加坡的影响力

Google DeepMind 正在新加坡开设一个新的研究实验室,以推动亚太地区的前沿 AI 研究和应用。

89

Gemini 3 发布说明

Google DeepMind 已发布 Gemini 3,这是一种具有先进推理、智能体编码能力以及全新 Deep Think 模式以解决复杂问题的最先进多模态模型。

90

Google Antigravity: 智能体开发平台发布

Google DeepMind 已推出 Google Antigravity,这是一个以智能体为先的开发平台,使 AI 能够在 IDE、终端和浏览器之间自主规划和执行复杂的软件任务。

91

WeatherNext 2 发布说明 / 新功能

Google DeepMind 已发布 WeatherNext 2,这是一个 AI 天气预报模型,相比之前的版本生成预报速度快 8 倍,分辨率可达 1 小时,并且在 99.9% 的变量上准确性得到提升。

92

SIMA 2: 一个在虚拟 3D 世界中与你一起玩耍、推理和学习的代理

Google DeepMind 推出了 SIMA 2,这是一个通用型 AI 代理,集成了 Gemini 模型,使其能够超越简单的指令跟随,在虚拟 3D 环境中进行推理、对话和自我改进。

93

Google DeepMind 视觉对齐研究

谷歌DeepMind开发了一种三步对齐方法,重组AI视觉表示以匹配人类概念层次,提高模型鲁棒性和泛化能力。

94

Google DeepMind Gemini AI 在北爱尔兰学校的试点

北爱尔兰涉及100名教师使用Gemini和Google Workspace工具的六个月试点项目使每位教师平均每周节省10小时。

95

Google DeepMind 使用 AI 进行映射、建模和理解自然

Google DeepMind 宣布了新的 AI 研究和工具,用于预测森林砍伐风险、大规模映射物种分布,以及通过 Perch 2.0 生物声学模型识别动物叫声。

96

Google DeepMind AI for 数学 倡议

Google DeepMind 和 Google.org 启动了 AI for 数学 倡议,这是一个与五家享有盛誉的研究机构合作的项目,旨在使用如 Gemini Deep Think、AlphaEvolve 和 AlphaProof 等 AI 工具加速数学发现。

97

T5Gemma: 通过 Decoder-Only 适配实现 Encoder-Decoder LLMs

Google DeepMind 推出了 T5Gemma,这是一系列通过适配预训练的 decoder-only Gemma 2 模型而创建的 encoder-decoder 模型,旨在提高推理效率和推理性能。

98

MedGemma 和 MedSigLIP 发布说明

Google DeepMind 发布了 MedGemma 和 MedSigLIP,这是一系列开放的多模态模型,旨在为医疗和生命科学 AI 开发提供高性能且保护隐私的基础。

99

Gemma 3n 发布说明 / 新功能

Google DeepMind 已发布 Gemma 3n,这是一款面向移动端的多模态模型系列,采用嵌套的 MatFormer 架构,实现弹性推理并在边缘设备上提供高性能。

100

Gemini 2.5 Flash-Lite 发布说明

Google DeepMind 已发布 Gemini 2.5 Flash-Lite 的稳定版,这是 Gemini 2.5 系列中最快且最具成本效益的模型,具有 100 万令牌上下文窗口和原生推理能力。