归档 · 11 个实验室 · 3,052 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

1251

变化的全球算力格局:中国在 AI 硬件与软件领域的崛起

Hugging Face 分析了美国出口管制如何矛盾地加速了中国开发国产 AI 芯片和高计算效率开源权重模型的过程,从而创造了一个平行的 AI 基础设施。

1252

NVIDIA Isaac for Healthcare v0.4:从仿真到部署构建医疗机器人

NVIDIA Isaac for Healthcare v0.4 引入了一种端到端工作流,通过使用 SO-ARM starter 工作流,将合成仿真数据与现实世界训练相结合,用于构建自主手术助手。

1253

OpenAI gpt-oss-safeguard 技术报告

OpenAI 发布了 gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b,这些是专门用于根据提供的政策进行内容分类的开放权重推理模型。

1254

gpt-oss-safeguard 发布说明 / 新功能

OpenAI 已发布 gpt-oss-safeguard,这是一套用于安全分类任务的开源权重推理模型,允许开发者在推理时应用自定义策略。

1255

Anthropic 研究:大语言模型中涌现的内省意识

Anthropic 研究表明,Claude 模型,特别是 Opus 4 和 4.1,展示了有限但真实的监控和控制其自身内部神经状态的能力。

1256

Anthropic 进军日本,设立东京办事处并建立 AI 安全合作伙伴关系

Anthropic 已在东京开设了其在亚太地区的第一个办事处,并与日本 AI 安全研究所签署了合作备忘录,以建立国际 AI 评估标准。

1257

OpenAI gpt-oss-safeguard 模型通过 Ollama 发布

OpenAI 和 Ollama 发布了基于 Apache 2.0 许可的开源 gpt-oss-safeguard 安全推理模型(20B 和 120B),使组织能够通过透明的推理过程进行策略驱动的内容分类。

1258

NVIDIA Isaac for Healthcare v0.4 发布

NVIDIA Isaac for Healthcare v0.4 引入了一个开发者框架和 SO-ARM 起始工作流,以实现从仿真到真实世界部署的端到端 AI 医疗机器人开发。

1259

大日本印刷(DNP)ChatGPT Enterprise 部署结果

大日本印刷(DNP)在十个核心部门部署 ChatGPT Enterprise 后,实现了每周活跃使用率 100% 和专利研究时间缩减 95%。

1260

IBM Granite 4.0 Nano 发布说明

IBM 发布了 Granite 4.0 Nano,这是一系列专为边缘和设备端应用设计的高性能小型语言模型(SLM),并在 Apache 2.0 许可证下发布。

1261

Doppel AI 防御系统:使用 GPT-5 和 o4-mini 自动化威胁检测

Doppel 已部署一个基于 OpenAI 的 GPT-5 和 o4-mini 模型的 AI 驱动防御系统,以自动化检测和下架冒充网站和钓鱼攻击,将响应时间从小时缩短到分钟。

1262

OpenAI 公司重新资本化和 OpenAI 基金会的启动

OpenAI 已完成公司重新资本化,成立 OpenAI 基金会作为控制营利性 OpenAI Group PBC 的非营利组织,以确保通用人工智能(AGI)造福全人类。

1263

Microsoft 和 OpenAI 合作伙伴关系更新 2025

Microsoft 和 OpenAI 已签署一项新的确定性协议,将 OpenAI 转变为公共利益公司,并更新了知识产权、AGI 验证和计算协议。

1264

Hugging Face Voice Cloning with Consent

Hugging Face 推出了语音同意门控,这是一种系统基础设施,要求说话者通过录制的短语明确表达同意,之后语音克隆模型才能被激活。

1265

MiniMax M2 在 Ollama Cloud 上发布

MiniMax M2 是一款针对编程和智能体工作流优化的高性能模型,现已在 Ollama 的云端平台可用。

1266

OpenAI 美国人工智能领导力和能源基础设施战略

OpenAI 倡导启动一项国家项目,每年新建 100 吉瓦的能源容量,以维持美国在人工智能领域的领先地位,并避免与中国之间的电子差距。

1267

GPT-5 系统卡片补充:敏感对话

OpenAI 已更新 GPT-5,以更好地识别和支持处于情绪困境的用户,通过与超过 170 名心理健康专家合作,将次优响应减少了 65-80%。

1268

OpenAI 加强 ChatGPT 对敏感对话的响应

OpenAI 已更新 ChatGPT 的默认模型(GPT-5),以更好地识别和支持处于困境中的用户,使心理健康、自残和情感依赖场景下的不良响应减少 65% 至 80%。

1269

huggingface_hub v1.0:五年构建开放机器学习基础

huggingface_hub 在五年后已达到 v0.1,提供对超过 200 万模型、50 万数据集和 100 万 Spaces 的核心访问,同时引入了诸如 httpx、hf_xet 以及重新设计的 CLI 等破坏性变更,以支持下一个十年的开放机器学习。

1270

Hugging Face 流式数据集更新

Hugging Face 已优化 datasets 库的流式功能,将启动请求减少了 100 倍,并将数据解析速度提高了 10 倍,以实现无需本地下载即可高效训练多 TB 数据集。

1271

Steuerrecht.com 案例研究:使用 ChatGPT Business 扩展法律分析

Steuerrecht.com 使用 ChatGPT Business 自动化常规法律起草、研究和多语言沟通,将某些任务从几天缩短到几分钟,并为每位律师每周节省多达 10 小时的工作时间。

1272

推进 Claude 在金融服务领域的应用

Anthropic 已通过推出新的 Excel 插件、实时市场数据连接器以及针对复杂金融建模与分析的专用 Agent Skills,扩展了 Claude for Financial Services 的功能。

1273

T5Gemma: 通过 Decoder-Only 适配实现 Encoder-Decoder LLMs

Google DeepMind 推出了 T5Gemma,这是一系列通过适配预训练的 decoder-only Gemma 2 模型而创建的 encoder-decoder 模型,旨在提高推理效率和推理性能。

1274

MedGemma 和 MedSigLIP 发布说明

Google DeepMind 发布了 MedGemma 和 MedSigLIP,这是一系列开放的多模态模型,旨在为医疗和生命科学 AI 开发提供高性能且保护隐私的基础。

1275

Gemma 3n 发布说明 / 新功能

Google DeepMind 已发布 Gemma 3n,这是一款面向移动端的多模态模型系列,采用嵌套的 MatFormer 架构,实现弹性推理并在边缘设备上提供高性能。

1276

Gemini 2.5 Flash-Lite 发布说明

Google DeepMind 已发布 Gemini 2.5 Flash-Lite 的稳定版,这是 Gemini 2.5 系列中最快且最具成本效益的模型,具有 100 万令牌上下文窗口和原生推理能力。

1277

Google DeepMind Veo:将生成视频融入现场实拍电影制作《ANCESTRA》

Google DeepMind 与导演 Eliza McNitt 以及 Darren Aronofsky 创立的 Primordial Soup 合作制作短片《ANCESTRA》,展示了 Veo 如何通过个性化生成和运动匹配,将生成视频与现场实拍画面融合。

1278

AlphaEarth Foundations:统一的地理空间嵌入用于全球制图

Google DeepMind 推出了 AlphaEarth Foundations,这是一款将数拍字节的多模态地球观测数据整合为统一数字嵌入的 AI 模型,旨在革新全球制图和环境监测。

1279

Mistral AI Studio: 企业级 AI 生产平台

Mistral AI 推出了 AI Studio,这是一个生产级平台,旨在通过可观测性 (Observability)、智能体运行时 (Agent Runtime) 和 AI 注册表 (AI Registry) 三大核心支柱,将企业级 AI 从原型设计转向可靠、受治理的系统。

1280

DeepMind Backstory 实验性图像来源与可信度工具

Google DeepMind 宣布推出 Backstory,这是一款实验性的 AI 工具,使用 Gemini 模型揭示图像的 AI 生成状态、来源、修改以及不断演变的上下文,帮助用户评估其可信度。

1281

Gemini Deep Think 在 IMO 2025 中达到金牌标准

Gemini 的高级 Deep Think 版本在国际数学奥林匹克中解答了六道题中的五道,获得 35 分,达到了金牌标准。

1282

Google DeepMind Aeneas:用于古代铭文情境化的 AI

Google DeepMind 推出了 Aeneas,这是首个旨在帮助历史学家通过多模态分析和并行文本检索来解释、归属和修复零碎拉丁铭文的 AI 模型。

1283

Genie 3 实时世界模型发布

Genie 3 是 DeepMind 的新实时世界模型,能够以 24 fps 生成交互式 720p 环境,并在数分钟内保持一致性,支持先进的具身代理研究。

1284

Google DeepMind Perch 更新:推动濒危物种的生物声学研究

Google DeepMind 发布了更新的开源 Perch 模型,提升了鸟类物种预测能力,并将生物声学分析扩展到哺乳动物、两栖动物以及珊瑚礁等水下环境。

1285

Google DeepMind 深度环形整形用于 LIGO 引力波天文台

Google DeepMind 推出了 Deep Loop Shaping,这是一种 AI 方法,可将 LIGO 反馈系统中的控制噪声降低 30 到 100 倍,从而实现更精确的引力波探测。

1286

Gemini 2.5 Deep Think ICPC 世界总决赛表现

Gemini 2.5 Deep Think 的高级版本在2025年国际大学生程序设计竞赛(ICPC)世界总决赛中实现了金牌水平的表现,解决了12道复杂算法题中的10道。

1287

Google DeepMind 使用 AI 发现新的流体动力学奇点

Google DeepMind 开发了一种基于物理信息神经网络(PINNs)的新型 AI 方法,能够在流体动力学方程中发现新的不稳定奇点族,为解决长期存在的数学难题提供了新路径。

1288

LeRobot v0.4.0 发布说明 / 新功能

Hugging Face 发布了 LeRobot v0.4.0,引入了可扩展的 Datasets v3.0、PI0.5 和 GR00T N1.5 等 VLA 模型,以及用于简化硬件集成的插件系统。

1289

Google DeepMind 前沿安全框架更新

Google DeepMind 发布了其前沿安全框架(FSF)的第三版,引入了针对有害操纵和错位 AI 的新风险领域,并新增了可追踪能力层级(TCL),以实现更早的风险检测。

1290

Gemini Robotics 1.5 与 Gemini Robotics-ER 1.5 发布

Google DeepMind 推出了 Gemini Robotics 1.5 和 Gemini Robotics-ER 1.5,这两款模型将高层具身推理与直接的视觉语言动作控制相结合,使机器人能够执行复杂的多步骤物理任务。

1291

Google DeepMind CodeMender AI 代码安全代理

Google DeepMind 推出了 CodeMender,这是一款 AI 驱动的代理,能够自动识别、修补并主动保护开源项目中的软件漏洞。

1292

Google DeepMind 与 Commonwealth Fusion Systems 的聚变能源合作伙伴关系

Google DeepMind 正与 Commonwealth Fusion Systems 合作,利用 AI、强化学习和 TORAX 模拟器,加速在 SPARC 托卡马克中实现净聚变能量的进程。

1293

Gemini 2.5 深度思考发布

Google DeepMind 已在 Gemini 应用中为 Google AI Ultra 订阅者推出 Deep Think,引入并行思考技术,以提升在编码、科学和数学等复杂问题求解中的能力。

1294

Google DeepMind 与 Kaggle 推出用于 AI 评估的 Game Arena

Google DeepMind 与 Kaggle 推出了 Game Arena,这是一款开源平台,通过在策略游戏中的对抗竞争来评估 AI 模型,从而提供对通用问题解决能力的可验证衡量。

1295

OpenAI 收购 Software Applications Incorporated,以将 Sky 集成到 ChatGPT 中

OpenAI 已收购 Software Applications Incorporated(Sky 的创作者),以将深度 macOS 集成和自然语言界面整合到 ChatGPT 中。

1296

Consensus Scholar Agent:使用 GPT-5 和 Responses API 的研究自动化

Consensus 已推出 Scholar Agent,这是一套由 GPT-5 和 Responses API 驱动的多代理系统,可自动合成覆盖 2.2 亿篇论文的同行评审文献。

1297

Hugging Face 与 Meta 推出用于代理环境的 OpenEnv

Hugging Face 与 Meta 已推出 OpenEnv 及 OpenEnv Hub,这是一个标准化、开放的社区中心,用于在训练和部署中使用的安全沙箱代理环境。

1298

OpenAI 为 ChatGPT Business、Enterprise 和 Edu 推出公司知识功能

OpenAI 为 ChatGPT Business、Enterprise 和 Edu 推出了公司知识功能,使用户能够通过 GPT‑5 模型查询内部工具(如 Slack 和 Google Drive),并提供引用,同时保持数据私密。

1299

OpenAI 韩国经济蓝图

OpenAI 发布了针对韩国的经济蓝图,提出通过结合主权 AI 能力和战略前沿 AI 合作伙伴关系的双轨策略来提升国家生产力。

1300

Anthropic 宣布在首尔开设新办事处以扩大亚太地区业务布局

Anthropic 将于 2026 年初在首尔开设办事处,以支持在韩国的快速增长,该国 Claude Code 的使用量在四个月内增长了六倍。