DeepMind Backstory 实验性图像来源与可信度工具
Google DeepMind 宣布推出 Backstory,这是一款实验性的 AI 工具,使用 Gemini 模型揭示图像的 AI 生成状态、来源、修改以及不断演变的上下文,帮助用户评估其可信度。
Gemini Deep Think 在 IMO 2025 中达到金牌标准
Gemini 的高级 Deep Think 版本在国际数学奥林匹克中解答了六道题中的五道,获得 35 分,达到了金牌标准。
Google DeepMind Aeneas:用于古代铭文情境化的 AI
Google DeepMind 推出了 Aeneas,这是首个旨在帮助历史学家通过多模态分析和并行文本检索来解释、归属和修复零碎拉丁铭文的 AI 模型。
Genie 3 实时世界模型发布
Genie 3 是 DeepMind 的新实时世界模型,能够以 24 fps 生成交互式 720p 环境,并在数分钟内保持一致性,支持先进的具身代理研究。
Google DeepMind Perch 更新:推动濒危物种的生物声学研究
Google DeepMind 发布了更新的开源 Perch 模型,提升了鸟类物种预测能力,并将生物声学分析扩展到哺乳动物、两栖动物以及珊瑚礁等水下环境。
Google DeepMind 深度环形整形用于 LIGO 引力波天文台
Google DeepMind 推出了 Deep Loop Shaping,这是一种 AI 方法,可将 LIGO 反馈系统中的控制噪声降低 30 到 100 倍,从而实现更精确的引力波探测。
Gemini 2.5 Deep Think ICPC 世界总决赛表现
Gemini 2.5 Deep Think 的高级版本在2025年国际大学生程序设计竞赛(ICPC)世界总决赛中实现了金牌水平的表现,解决了12道复杂算法题中的10道。
Google DeepMind 使用 AI 发现新的流体动力学奇点
Google DeepMind 开发了一种基于物理信息神经网络(PINNs)的新型 AI 方法,能够在流体动力学方程中发现新的不稳定奇点族,为解决长期存在的数学难题提供了新路径。
LeRobot v0.4.0 发布说明 / 新功能
Hugging Face 发布了 LeRobot v0.4.0,引入了可扩展的 Datasets v3.0、PI0.5 和 GR00T N1.5 等 VLA 模型,以及用于简化硬件集成的插件系统。
Google DeepMind 前沿安全框架更新
Google DeepMind 发布了其前沿安全框架(FSF)的第三版,引入了针对有害操纵和错位 AI 的新风险领域,并新增了可追踪能力层级(TCL),以实现更早的风险检测。
Gemini Robotics 1.5 与 Gemini Robotics-ER 1.5 发布
Google DeepMind 推出了 Gemini Robotics 1.5 和 Gemini Robotics-ER 1.5,这两款模型将高层具身推理与直接的视觉语言动作控制相结合,使机器人能够执行复杂的多步骤物理任务。
Google DeepMind CodeMender AI 代码安全代理
Google DeepMind 推出了 CodeMender,这是一款 AI 驱动的代理,能够自动识别、修补并主动保护开源项目中的软件漏洞。
Google DeepMind 与 Commonwealth Fusion Systems 的聚变能源合作伙伴关系
Google DeepMind 正与 Commonwealth Fusion Systems 合作,利用 AI、强化学习和 TORAX 模拟器,加速在 SPARC 托卡马克中实现净聚变能量的进程。
Gemini 2.5 深度思考发布
Google DeepMind 已在 Gemini 应用中为 Google AI Ultra 订阅者推出 Deep Think,引入并行思考技术,以提升在编码、科学和数学等复杂问题求解中的能力。
Google DeepMind 与 Kaggle 推出用于 AI 评估的 Game Arena
Google DeepMind 与 Kaggle 推出了 Game Arena,这是一款开源平台,通过在策略游戏中的对抗竞争来评估 AI 模型,从而提供对通用问题解决能力的可验证衡量。
OpenAI 收购 Software Applications Incorporated,以将 Sky 集成到 ChatGPT 中
OpenAI 已收购 Software Applications Incorporated(Sky 的创作者),以将深度 macOS 集成和自然语言界面整合到 ChatGPT 中。
Consensus Scholar Agent:使用 GPT-5 和 Responses API 的研究自动化
Consensus 已推出 Scholar Agent,这是一套由 GPT-5 和 Responses API 驱动的多代理系统,可自动合成覆盖 2.2 亿篇论文的同行评审文献。
Hugging Face 与 Meta 推出用于代理环境的 OpenEnv
Hugging Face 与 Meta 已推出 OpenEnv 及 OpenEnv Hub,这是一个标准化、开放的社区中心,用于在训练和部署中使用的安全沙箱代理环境。
OpenAI 为 ChatGPT Business、Enterprise 和 Edu 推出公司知识功能
OpenAI 为 ChatGPT Business、Enterprise 和 Edu 推出了公司知识功能,使用户能够通过 GPT‑5 模型查询内部工具(如 Slack 和 Google Drive),并提供引用,同时保持数据私密。
OpenAI 韩国经济蓝图
OpenAI 发布了针对韩国的经济蓝图,提出通过结合主权 AI 能力和战略前沿 AI 合作伙伴关系的双轨策略来提升国家生产力。
OpenAI英国主权AI更新
OpenAI宣布与英国司法部达成新协议,为2,500名公务员提供ChatGPT Enterprise,并为API、Enterprise和Edu客户推出英国数据驻留选项。
Hugging Face 与 VirusTotal 安全合作
Hugging Face 与 VirusTotal 合作,持续扫描 Hugging Face Hub 上超过 220 万个公开模型和数据集仓库,以保护机器学习社区免受恶意资产的侵害。
Sentence Transformers 加入 Hugging Face
Sentence Transformers 库正从 TU Darmstadt 的 UKP 实验室迁移到 Hugging Face,以利用更好的基础设施推动持续的开源开发。
OpenAI 日本经济蓝图
OpenAI 发布了《日本经济蓝图》,这是一项政策框架,旨在帮助日本通过包容性获取、基础设施投资和教育,利用 AI 将国内生产总值提升至多 16%。
ChatGPT WhatsApp 集成停用
OpenAI 宣布,由于 WhatsApp 政策和条款的变更,ChatGPT 将在 2026 年 1 月 15 日之后不再可在 WhatsApp 上使用。
Hugging Face AI Sheets 视觉更新
Hugging Face AI Sheets 是一款开源工具,现已支持视觉功能,允许用户从图像中提取结构化数据、从文本生成视觉内容,并在电子表格界面中编辑图像。
ChatGPT Atlas 发布说明
OpenAI 已推出 ChatGPT Atlas,这是一款在核心集成了 ChatGPT 的网页浏览器,实现了上下文感知浏览、浏览器记忆以及原生代理任务自动化。
开源 OCR 模型指南 – 选择、运行与扩展现代视觉语言 OCR
Hugging Face 发布了一份全面的开源权重 OCR 模型指南,详细说明了它们的功能、基准性能、成本效率以及如何在本地或通过托管端点运行它们。
AI for Food Allergies:面向生物医学研究的开放数据集集合
Hugging Face 已启动 AI for Food Allergies 项目,推出首个开放的、社区驱动的精心策划数据集集合,以加速基于 AI 的过敏原预测、药物发现和食品安全。
Google Cloud C4 与 Intel Xeon 6 在 GPT OSS 上的性能
Google Cloud C4 虚拟机搭载 Intel Xeon 6 处理器,在 GPT OSS MoE 模型推理方面相比 C3 虚拟机可实现最高 1.7 倍的总拥有成本(TCO)提升。
Plex Coffee 案例研究:使用 ChatGPT Business 扩展运营
Plex Coffee 利用 ChatGPT Business 将入职培训时间从数周缩短至数天,并通过自动化知识共享和自定义 GPT 将运营 WhatsApp 消息减少超过 50%。
在 Intel CPU 上使用 OpenVINO 运行 SmolVLM 的 3 步骤
Hugging Face 展示了如何使用 Optimum‑Intel 和 OpenVINO 在 Intel CPU 上部署小型视觉语言模型 SmolVLM,实现比 PyTorch 高达 65 倍的吞吐量。
OpenAI 福祉与 AI 专家委员会
OpenAI 已成立福祉与 AI 专家委员会,这是一个由研究人员和临床医生组成的多学科团队,旨在就健康的 AI 交互以及技术对心理健康的影响提供建议。
OpenAI 与 Sur Energy 探索阿根廷的 Stargate 项目
OpenAI 与 Sur Energy 已签署意向书,探索在阿根廷建设大型 AI 数据中心(即 Stargate 项目),以利用该国的清洁能源和开发者生态系统。
Nemotron-Personas-India:用于主权 AI 的合成数据
NVIDIA 已发布 Nemotron-Personas-India,这是一套采用 CC BY 4.0 许可证的合成数据集,包含 2100 万印度语系人物,旨在弥补印度多语言和文化多样环境中主权 AI 的数据缺口。
OpenAI 与 Broadcom 在 AI 加速器方面的战略合作
OpenAI 与 Broadcom 合作,在 2026 至 2029 年间部署 10 吉瓦的定制 AI 加速器,这些加速器由 OpenAI 设计并由 Broadcom 网络解决方案提供动力。
Arm 参加 2025 年 PyTorch 大会
Arm 将于 10 月 22-23 日参加 PyTorch 大会,展示包括 ExecuTorch 和 vLLM 在内的 AI 部署工具,并收集开发者关于在云、边缘和移动平台上扩展 AI 的反馈。
HYGH 案例研究:使用 ChatGPT Business 扩展数字广告规模
数字媒体公司 HYGH 使用 ChatGPT Business,每位员工每周节省 5.5 小时,并将软件 MVP 的交付周期从数月加速到每周一次。
OpenAI 在大型语言模型中的政治偏见定义与评估
OpenAI 开发了一个用于衡量大型语言模型政治偏见的新评估框架,发现相较于之前的版本,`GPT-5` 系列模型将偏见降低了 30%,且在生产响应中出现偏见的比例不足 0.01%。
HiBob AI 采用与 GPT 实施策略
HiBob 已集成 ChatGPT Enterprise,创建了超过 2,500 个实验性 GPT,实现了 90% 的员工采用率,并将 AI 驱动的功能部署到其核心人力资源平台。
BigCodeArena:端到端评估代码生成的执行
Hugging Face 推出了 BigCodeArena,这是一款人类参与的平台,通过让用户实时执行并交互生成的代码来评估代码生成模型。
OpenAI 打击 AI 恶意使用 2025年10月更新
自2024年2月以来,OpenAI 已中断超过40个违反使用政策的网络,并指出威胁行为者主要利用 AI 加速现有攻击剧本,而非开发全新的攻击能力。
OpenAI Codex 通用可用性
OpenAI 宣布 Codex 正式面向公众提供,推出 Slack 集成、TypeScript SDK,以及为工程团队提供的增强管理工具。
OpenAI 在 ChatGPT 中推出应用程序及 Apps SDK
OpenAI 已在 ChatGPT 中推出应用程序,并基于模型上下文协议 (MCP) 提供相应的 Apps SDK,使开发者能够将交互式界面和逻辑直接集成到对话式 AI 中。
AMD 与 OpenAI 的 AI 基础设施战略合作伙伴关系
AMD 与 OpenAI 已签署一项多年、多代的协议,部署 6 吉瓦的 AMD GPU,首阶段将在 2026 年下半年首次部署 1 吉瓦的 Instinct MI450 GPU。
OpenAI 与 Allied for Startups 发布 Hacktivate AI 报告
OpenAI 与 Allied for Startups 已发布 Hacktivate AI 报告,包含 20 项政策提案,以加速 AI 在欧洲的采用和竞争力。
OpenAI AgentKit 发布说明
OpenAI 推出了 AgentKit,这是一套包括 Agent Builder、Connector Registry 和 ChatKit 在内的工具,旨在简化 AI 代理的设计、部署和优化。
Wrtn 生活方式 AI 与 GPT-5 的整合
Wrtn 已将 GPT-5 集成,以在韩国扩展其“生活方式 AI”生态系统,实现了日活跃用户增长 8%,并提升了意图分类和个性化的性能。
使用 Core ML 和 dots.ocr 的最先进 OCR
Hugging Face 展示了将 3B 参数的 dots.ocr 模型转换为在设备上使用 Core ML 和 MLX 运行的过程,实现了在 OmniDocBench 上超越 Gemini 2.5 Pro 的性能。
OpenAI 与日本数字厅的战略合作
OpenAI 与日本数字厅正合作,通过为政府员工部署名为 Gennai 的新 AI 工具,将生成式 AI 融入公共服务。