✷ 归档 · 11 个实验室 · 3,052 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Google Antigravity: 智能体开发平台发布
Google DeepMind 已推出 Google Antigravity,这是一个以智能体为先的开发平台,使 AI 能够在 IDE、终端和浏览器之间自主规划和执行复杂的软件任务。
Intuit 和 OpenAI 宣布多年合作伙伴关系,将 Intuit 应用带入 ChatGPT
Intuit 和 OpenAI 宣布了一项多年战略合作伙伴关系,该合作将把 Intuit 的财务应用集成到 ChatGPT 中,并在 $100M+ 协议下扩大 Intuit 对 OpenAI 前沿模型的使用。
Microsoft、NVIDIA 和 Anthropic 战略合作
Anthropic 正在使用 NVIDIA 架构于 Microsoft Azure 上扩展 Claude,获得 Microsoft 和 NVIDIA 联合 150 亿美元的投资支持。
Claude 与 Microsoft Foundry 及 Microsoft 365 Copilot 的集成
Anthropic 扩展了与 Microsoft 的合作伙伴关系,使 Claude Sonnet 4.5、Haiku 4.5 和 Opus 4.1 可在 Microsoft Foundry 和 Microsoft 365 Copilot 中使用。
WeatherNext 2 发布说明 / 新功能
Google DeepMind 已发布 WeatherNext 2,这是一个 AI 天气预报模型,相比之前的版本生成预报速度快 8 倍,分辨率可达 1 小时,并且在 99.9% 的变量上准确性得到提升。
Anthropic 与卢旺达政府及 ALX 合作开展非洲 AI 教育
Anthropic 已与卢旺达政府和 ALX 合作,向非洲各地的数十万名学习者和教育工作者部署 Chidi,这是一个由 Claude 驱动的学习伙伴。
OpenAI 在 Gartner 生成式 AI 模型提供商指南中被命名为新兴领导者
OpenAI 被评为 Gartner 2025 年 11 月创新指南中的生成式 AI 模型提供商新兴领导者,这反映了其企业采用的快速增长以及基础设施投资。
轻松使用 Hugging Face 构建和共享 ROCm 内核
Hugging Face 介绍了一种使用 kernels 库和 kernel-builder 的简化工作流程,以在 Hugging Face Hub 上构建、打包和共享 ROCm 兼容的 GPU 内核。
xAI Grok 4.1 发布说明
xAI 已发布 Grok 4.1,这是一个针对情绪智能、创意写作和减少幻觉而优化的模型,目前在 LMArena Text Leaderboard 上占据榜首位置。
OpenAI for Ireland 倡议
OpenAI 已启动 'OpenAI for Ireland',这是一个与爱尔兰政府、Dogpatch Labs 和 Patch 合作的战略倡议,旨在加速中小企业、早期创始人和年轻建造者的 AI 采用。
AMD 开放机器人黑客马拉松
AMD、Hugging Face 和 Data Monsters 在东京和巴黎举办 AMD 开放机器人黑客马拉松,以鼓励使用 LeRobot 和 AMD AI 硬件开发创新的机器人解决方案。
SIMA 2: 一个在虚拟 3D 世界中与你一起玩耍、推理和学习的代理
Google DeepMind 推出了 SIMA 2,这是一个通用型 AI 代理,集成了 Gemini 模型,使其能够超越简单的指令跟随,在虚拟 3D 环境中进行推理、对话和自我改进。
OpenAI 通过稀疏电路理解神经网络
OpenAI 研究人员开发了一种训练稀疏语言模型的方法,这些模型包含小型、解耦的电路,为理解复杂 AI 行为的机制可解释性提供了更易行的路径。
Hugging Face 和 Google Cloud 战略合作伙伴关系
Hugging Face 和 Google Cloud 已进入深化的战略合作伙伴关系,以简化在 Google Cloud 基础设施上部署开放模型,特点是新增 CDN 网关以实现更快的模型下载,并通过 Google Threat Intelligence 提升安全性。
ChatGPT 群聊发布
OpenAI 在 ChatGPT 中引入了群聊功能,允许多个用户在 Free、Go、Plus 和 Pro 计划的共享对话空间中相互协作并与 AI 合作。
Philips AI 素养扩展策略
Philips 正在采用分阶段方法,在 70,000 名员工中推广 AI 素养,以实现从个人生产力到医疗保健领域工作流级自动化的过渡。
OpenAI GPT-5.1 发布说明
OpenAI 已发布 GPT-5.1,这是一种通过自适应推理、全新的“无推理”模式以及专门的编码工具来优化智能与速度平衡的模型。
Anthropic 与马里兰州政府服务合作伙伴关系
马里兰州正与 Anthropic 合作,在多个州级机构中部署 Claude AI 模型,以简化福利申请、协助案件处理人员,并支持社区服务的识别。
Anthropic 打破了首个由 AI 编排的网络间谍活动
Anthropic 检测并挫败了一场由中国政府支持的组织发起的复杂间谍活动,该组织利用 agentic AI 自动化了大规模网络攻击中 80-90% 的工作。
Qwen DeepResearch 2511 发布
Qwen 已发布 Qwen DeepResearch 2511,这是一款利用多代理协作机制的 AI 研究助理,旨在降低初始灵感与深度技术验证之间的摩擦。
Neuro 使用 ChatGPT Business 扩大全国零售运营
Neuro 使用 ChatGPT Business 优化法律成本,分析客户情绪,并优化营销活动,使得不到 70 人的精简团队能够维持一个九位数的品牌。
OpenAI 隐私保护与《纽约时报》数据需求
OpenAI 正在挑战来自《纽约时报》的一项法院要求,要求交出 2000 万条随机抽取的 ChatGPT 对话,以保护用户隐私。
GPT-5.1 Instant 和 GPT-5.1 Thinking 系统卡片附录
OpenAI 已发布 GPT-5.1 Instant 和 GPT-5.1 Thinking 的系统卡片附录,引入自适应推理并扩展了对心理健康和情感依赖的安全评估。
GPT-5.1 发布说明:增强的智能和对话语气
OpenAI 已发布 GPT-5.1,推出 GPT-5.1 Instant 和 GPT-5.1 Thinking,这些版本具备改进的推理能力、自适应思考时间以及为 ChatGPT 扩展的个性化定制选项。
项目 Fetch:评估 Claude 对机器人任务表现的影响
Anthropic 的项目 Fetch 实验表明,使用 Claude 的研究人员在完成复杂的机器人狗编程任务时,显著快于且更成功于没有 AI 辅助的团队。
Anthropic 在美国 AI 基础设施领域投资 500 亿美元
Anthropic 将通过与 Fluidstack 合作,投资 500 亿美元在德克萨斯州和纽约州建设定制化 AI 数据中心,以支持前沿研究和业务增长。
Google DeepMind 视觉对齐研究
谷歌DeepMind开发了一种三步对齐方法,重组AI视觉表示以匹配人类概念层次,提高模型鲁棒性和泛化能力。
Google DeepMind Gemini AI 在北爱尔兰学校的试点
北爱尔兰涉及100名教师使用Gemini和Google Workspace工具的六个月试点项目使每位教师平均每周节省10小时。
OpenAI 为正在过渡的美国现役军人和退役军人提供免费 ChatGPT Plus
OpenAI 向退役或离岗不超过 12 个月的美国现役军人和退役军人提供免费一年的 ChatGPT Plus,以帮助他们过渡到平民生活。
OpenAI 提示注入安全概览
OpenAI 概述了提示注入攻击的性质以及多层防御策略,以在 AI 代理获得更多自主权和数据访问时保护用户。
Anthropic 通过在巴黎和慕尼黑开设新办公室扩大欧洲业务布局
Anthropic 正在巴黎和慕尼黑开设新办公室,以支持 EMEA 地区的快速增长,该地区的运行率收入在过去一年中增长了 9 倍以上。
OpenAI AI 进展与建议
OpenAI 概述了 AI 能力向自主发现发展的轨迹,并提出了弹性生态系统和共享安全标准,以管理向超智能的过渡。
OpenAI 青少年安全蓝图
OpenAI 推出了青少年安全蓝图,这是一个旨在建立适龄 AI 设计、产品防护措施和研究标准的框架,以保护和赋能青少年用户。
CRED AI 实施以提升高端客户体验
CRED 已集成 OpenAI 模型,包括 GPT-4.0、GPT-5 和 o3,以推出 Cleo,一个 AI 对话伴侣,以及内部工具 Thea 和 Stark,以提升客户支持和运营效率。
Google DeepMind 使用 AI 进行映射、建模和理解自然
Google DeepMind 宣布了新的 AI 研究和工具,用于预测森林砍伐风险、大规模映射物种分布,以及通过 Perch 2.0 生物声学模型识别动物叫声。
Chime 如何通过 AI 重新定义营销
Chime 正在从以活动为中心的营销模式转向使用 AI 的代理模型,以实现实时个性化、提升内容速度和自动化媒体优化。
OpenAI 商业平台增长与企业工具更新
OpenAI 已达到 100 万企业客户,并推出了包括公司知识、AgentKit 和代理商务协议在内的新企业能力。
Anthropic 经济未来计划扩展至英国和欧洲
Anthropic 已将其经济未来计划扩展至英国和欧洲,旨在提供研究资助、人工智能采用数据以及政策论坛,以帮助应对人工智能对劳动力和生产力的影响。
Anthropic 关于模型弃用与保留的承诺
Anthropic 已承诺在公司存续期间保留所有公开发布和重大的内部模型的权重,以减轻安全风险并解决潜在的模型福利问题。
Cognizant 与 Anthropic 建立合作伙伴关系,推动企业级 AI 应用落地
Cognizant 正在向 350,000 名员工部署 Claude,并将 Anthropic 的智能体工具集成到其工程平台中,以加速企业级 AI 生产和遗留系统现代化。
Anthropic 与冰岛国家 AI 教育试点项目
Anthropic 与冰岛教育及儿童部合作启动了全球首批国家级 AI 教育试点项目之一,为冰岛所有地区的教师提供 Claude。
使用 MCP 进行代码执行:构建更高效的 AI Agent
Anthropic 推出了一种让 AI Agent 通过代码执行而非直接工具调用来与 Model Context Protocol (MCP) 服务器进行交互的方法,从而减少了 Token 消耗并提高了效率。
OpenAI 发布 IndQA 基准测试,用于印度语言和文化
OpenAI 已推出 IndQA,这是一个由专家编写的、覆盖 12 种语言的 2,278 道题目的新基准测试,用于评估 AI 在印度语境下的推理能力和文化理解。
AWS 和 OpenAI 战略合作伙伴关系
AWS 和 OpenAI 已达成一项涉及 380 亿美元承诺的多年战略合作伙伴关系,以向 OpenAI 提供包括 NVIDIA GPU 和 CPU 在内的大规模计算基础设施,以支持生成式 AI 和代理工作负载。
传递强化学习:通过分治法扩展离策略强化学习
BAIR 提出了传递强化学习(TRL),一种分治价值学习算法,它消除了时间差分(TD)学习,以无需 n 步调谐的方式将离策略强化学习扩展到长 horizon 任务。
OpenAI 正在将 Stargate 基础设施扩展到密歇根州
OpenAI 已宣布在密歇根州塞林镇新建一个 Stargate 校园,使规划容量增加到超过 8 吉瓦,总投资超过 4500 亿美元。
OpenAI Aardvark: 代理式安全研究员
OpenAI 已推出 Aardvark,一个由 GPT-5 驱动的自主代理,能够大规模识别、验证和修补软件漏洞,以将优势转向防御方。
MiniMax M2 代理对齐与泛化
MiniMax M2 实现了交错思考和全轨迹泛化,以弥合基准性能与真实世界代理可用性之间的差距。
OpenAI Atlas: 用于 AI 驱动浏览的 OWL 架构
OpenAI 推出了 OWL(OpenAI 的 Web 层),这是一种新的浏览器架构,它将 Chromium 运行时与主应用进程解耦,以在 Atlas 浏览器中实现更快的启动、原生 UI 性能以及具备代理能力的网页功能。
Google DeepMind AI for 数学 倡议
Google DeepMind 和 Google.org 启动了 AI for 数学 倡议,这是一个与五家享有盛誉的研究机构合作的项目,旨在使用如 Gemini Deep Think、AlphaEvolve 和 AlphaProof 等 AI 工具加速数学发现。