归档 · 11 个实验室 · 3,048 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

1051

OpenAI for Healthcare 发布

OpenAI 已推出 OpenAI for Healthcare,这是一套符合 HIPAA 的工具,包括 ChatGPT for Healthcare 和 OpenAI API,旨在减轻临床医生的行政负担并提升护理的一致性。

1052

Netomi 将代理系统扩展到企业 – 来自 OpenAI 的经验教训

Netomi 宣布了一款生产级代理平台,该平台结合了用于低延迟工具使用的 GPT‑4.1 和用于深度多步骤规划的 GPT‑5.2,实现了亚 3 秒响应、98% 意图准确率以及企业级规模的内置治理。

1053

Anthropic 与 PNNL AI 关键基础设施防御研究

Anthropic 与太平洋西北国家实验室 (PNNL) 证明了 Claude 可以加速关键基础设施防御中的对手模拟,将攻击重构时间从数周缩短至三小时。

1054

Qwen3-VL-Embedding 与 Qwen3-VL-Reranker 发布

Qwen 已发布 Qwen3-VL-Embedding 与 Qwen3-VL-Reranker,这是一系列针对文本、图像、截图和视频的高精度跨模态检索的多模态模型。

1055

Tolan 如何使用 GPT-5.1 构建语音优先 AI

Tolan 利用 GPT-5.1 和自定义实时上下文管理系统,创建了一个具有持久记忆和一致人格的低延迟语音优先 AI 伴侣。

1056

ChatGPT Health 发布说明

OpenAI 已推出 ChatGPT Health,这是一个专用且安全的体验,它整合了个人医疗记录和健康应用数据,帮助用户在不替代临床护理的情况下导航健康信息。

1057

xAI 完成 200 亿美元 E 轮融资

xAI 宣布完成 200 亿美元的 E 轮融资,超过了其 150 亿美元的目标,旨在加速其庞大的 AI 计算基础设施建设和产品发布。

1058

NVIDIA Cosmos Reason 2 发布说明 / 新功能

NVIDIA 已发布 Cosmos Reason 2,这是一款面向物理 AI 的开放推理视觉语言模型,位居 Physical AI Bench 和 Physical Reasoning 排行榜首位。

1059

Falcon-H1-Arabic 发布说明

Hugging Face 宣布了 Falcon-H1-Arabic,这是一系列三种混合 Mamba-Transformer 模型(3B、7B 和 34B),在扩展上下文窗口最高可达 256K tokens 的情况下,为阿拉伯语自然语言处理设定了新的最先进基准。

1060

NVIDIA DGX Spark 和 Reachy Mini 集成指南

NVIDIA 通过结合 DGX Spark 硬件、Reachy Mini 机器人技术以及使用开放推理和视觉模型的 NeMo Agent Toolkit,推出了一种创建真实世界 AI 代理的框架。

1061

OpenAI Grove 第二期公告

OpenAI 已开放 OpenAI Grove 第二期的申请,该项目旨在支持尚未有想法的技术人才构建 AI 驱动的公司。

1062

Qwen-Image-2512 发布说明 / 新功能

Qwen-Image-2512 是对 Qwen-Image 文本到图像模型的十二月更新,显著提升了人物真实感、自然细节渲染以及复杂文字布局的准确性。

1063

xAI 发布 Grok Business 和 Grok Enterprise

xAI 推出了 Grok Business 和 Grok Enterprise,为组织提供安全、具备权限感知的 AI 助手,且不会在客户数据上进行训练。

1064

Google DeepMind 2025 年度回顾:Gemini 3、Gemma、AI 产品、科学与安全突破

Google DeepMind 宣布了 2025 年在 Gemini 3 模型、开源 Gemma、AI 驱动的产品、生成式媒体、科学 AI、量子计算、安全框架以及全球合作方面的突破,标志着 AI 从工具向实用性的转变。

1065

AprielGuard:现代大型语言模型系统中的安全与对抗鲁棒性护栏

Hugging Face 和 ServiceNow AI 推出了 AprielGuard,这是一款拥有 8B 参数的安全防护模型,旨在检测 16 类安全风险以及在单独提示、多轮对话和代理工作流中的广泛对抗攻击。

1066

Qwen-Image-Edit-2511 发布说明

Qwen-Image-Edit-2511 是一个更新的图像编辑模型,提升了角色一致性,集成了社区 LoRAs,并增强了几何推理和工业设计能力。

1067

Qwen3-TTS-VD-Flash 与 Qwen3-TTS-VC-Flash 发布:可控语音设计与快速多语言语音克隆

Qwen 推出了用于自然语言语音设计的 Qwen3‑TTS‑VD‑Flash 和用于 3 秒多语言语音克隆的 Qwen3‑TTS‑VC‑Flash,两者在可控性和准确性方面均优于领先的 TTS 系统。

1068

ChatGPT Atlas: 加固浏览器代理以抵御提示注入

OpenAI 使用经过强化学习训练的自动化攻击者实施了一个主动的快速响应循环,以在野外被利用之前发现并缓解 ChatGPT Atlas 中的提示注入漏洞。

1069

OpenAI 客户增长与企业采用

OpenAI 已突破一百万企业客户,75% 的用户报告能够完成以前无法完成的任务。

1070

xAI 被美国战争部选中用于企业级 AI 和任务系统

xAI 已被美国战争部 (DOW) 选中,将其前沿 AI 系统和 Grok 模型集成到 GenAI.Mil 套件中,为 Impact Level 5 环境下的 300 万军事和文职人员提供 AI 能力。

1071

xAI Grok Collections API 发布

xAI 推出了 Collections API,这是一种托管式知识库服务,使开发者能够通过上传数据集来实现精确的语义、关键词和混合搜索,从而构建 RAG 应用。

1072

Qwen-Image-Layered:层次化分解实现内在可编辑性

Qwen-Image-Layered 是一种新模型,可将图像分解为多个 RGBA 层,实现对图像组件的独立操作而不影响其他内容。

1073

Anthropic Bloom: 用于自动化行为评估的开源工具

Anthropic 发布了 Bloom,这是一个开源的智能体框架,能够自动生成评估套件,以量化前沿 AI 模型中特定行为特征的频率和严重程度。

1074

Anthropic 为加州 SB 53 法案发布的前沿合规框架

Anthropic 已发布其前沿合规框架 (FCF),以满足加州《前沿 AI 透明度法案》(SB 53) 的透明度和安全要求。

1075

OpenAI 评估链式思考可监控性

OpenAI 引入了一个框架和 13 项评估来衡量“可监控性”——即从模型内部推理预测其行为的能力——并发现监控链式思考的效果显著优于仅监控输出。

1076

OpenAI Model Spec 更新:未满18岁(U18)原则

OpenAI 已更新其 Model Spec,加入未满18岁(U18)原则,为 ChatGPT 建立适龄行为准则,以优先保障13至17岁青少年的安全并提供现实世界的支持。

1077

OpenAI 面向青少年和家长的 AI 素养资源

OpenAI 已发布一套 AI 素养资源,包括家庭友好指南和针对父母的提示,以帮助家庭安全负责任地使用 ChatGPT。

1078

OpenAI 和美国能源部扩大人工智能合作

OpenAI 和美国能源部已签署谅解备忘录,将前沿人工智能模型融入科学研究,具体支持创世纪任务和国家实验室倡议。

1079

Transformers v5 分词更新

Hugging Face 在 Transformers v5 中重新设计了分词系统,将分词器的架构与已训练的词表分离,从而实现更容易的检查、定制和从头训练。

1080

GPT-5.2-Codex 发布说明

OpenAI 已发布 GPT-5.2-Codex,这是一款针对复杂软件工程、长期任务以及高级网络安全研究进行优化的代理式编码模型。

1081

OpenAI GPT-5.2-Codex 系统卡补充说明

OpenAI 已发布 GPT-5.2-Codex,这是一款针对复杂软件工程、项目规模重构和网络安全任务进行优化的代理式编码模型。

1082

Anthropic 项目 Vend 第二阶段:AI 店员实现盈利,但仍需人类监管

Anthropic 项目 Vend 第二阶段将店员 AI Claude(更名为 Claudius)升级至 Claude Sonnet 4.x,增加了工具、CEO 代理和商品制作代理,使三个地点的业务实现盈利,但暴露出持续的鲁棒性缺陷。

1083

Anthropic 宣布为 Claude 提供新的安全保障措施以保护用户福祉

Anthropic 详细介绍了 Claude 的新模型和产品安全保障措施,包括自杀/自残处理、减少谄媚行为以及 18 岁以上的年龄限制,其在内部评估中显示出高水平的适当性响应率。

1084

Anthropic 与美国能源部就 Genesis Mission 展开合作

Anthropic 已作为 Genesis Mission 的一部分与美国能源部建立了多年期合作伙伴关系,旨在将前沿 AI 整合到美国的能源主导地位、生物科学和科学生产力中。

1085

Mistral OCR 3 发布说明

Mistral AI 发布了 Mistral OCR 3,这是一款高保真文档解析模型,在复杂文档和手写内容上的表现相比前代提升了 74%,定价为每 1,000 页 2 美元。

1086

NVIDIA Nemotron 3 Nano 开放评估配方与 NeMo Evaluator

NVIDIA 发布了 30B Nemotron 3 Nano 模型,并提供基于 NeMo Evaluator 的完全开放评估配方,使任何人都能够复现其基准分数并审计整个评估流水线。

1087

Gemini 3 Flash 发行说明 / 新功能

Google DeepMind 已发布 Gemini 3 Flash,这是一种将前沿级推理和多模态智能与低延迟和降低成本相结合的模型,面向开发者和消费者。

1088

OpenAI 新闻机构学院启动

OpenAI 已推出 OpenAI 新闻机构学院,为记者提供培训、手册和负责任采用 AI 的指导,以提升报道和业务运营。

1089

OpenAI 为 ChatGPT 引入应用提交和目录

OpenAI 已推出应用目录和 beta Apps SDK,使开发者能够直接在 ChatGPT 中构建、提交和变现聊天原生体验。

1090

企业AI 2025现状报告

OpenAI 的 2025 年报告显示,企业 AI 采用正在快速规模化,ChatGPT 消息量年增长 8 倍,API 推理 token 消耗年增长 320 倍。

1091

xAI Grok Voice Agent API 发布

xAI 推出了 Grok Voice Agent API,这是一个高速、多语言的语音智能体系统,在 Big Bench Audio 中排名第一,且成本为每分钟 0.05 美元。

1092

Gemma Scope 2 发布 – 用于解释 Gemma 3 语言模型的开源工具

Gemma Scope 2 是一套针对 Gemma 3 模型(270M‑27B 参数)的开源可解释性工具,能够让研究人员追踪内部计算并调试安全关键行为。

1093

OpenAI FrontierScience 基准发布

OpenAI 已推出 FrontierScience,一个新的专家级基准,旨在衡量 AI 在物理、化学和生物学领域执行复杂科学推理和真实世界研究任务的能力。

1094

OpenAI GPT-5 生物研究能力

OpenAI 证明 GPT-5 能够自主优化分子克隆协议,通过发现一种新型酶促机制,实现了效率提升 79 倍。

1095

OpenAI 指南:在 AI 时代保持领先

OpenAI 概述了一套五步骤的指南——对齐、激活、放大、加速、治理——以帮助组织转变为 AI 首先的公司并保持竞争优势。

1096

ChatGPT Images 和 GPT Image 1.5 发布

OpenAI 已发布新一代旗舰图像生成模型 GPT Image 1.5,提供最高 4 倍更快的生成速度,并显著提升了精准编辑和文本渲染能力。

1097

Anthropic 为 Claude 推出的 "think" 工具

Anthropic 推出了 "think" 工具,这是一个专门的推理空间,旨在提高 Claude 在复杂任务中的智能体工具使用能力、政策遵循能力以及顺序决策能力。

1098

CUGA 在 Hugging Face 上:让可配置的 AI 智能体普及

IBM Research 发布了 CUGA(可配置通用智能体),这是一个开源智能体框架,在 AppWorld 和 WebArena 基准测试中实现了针对复杂 API 和 Web 任务的最先进性能。

1099

Gemini 2.5 Flash Native Audio 发布:增强型实时语音代理与实时语音翻译

Google DeepMind 发布了 Gemini 2.5 Flash Native Audio,这是一款实时语音模型,改进了函数调用、指令遵循和多轮对话,同时增加了支持 70 多种语言的实时语音到语音翻译功能。

1100

BBVA 和 OpenAI 战略性 AI 转型合作

BBVA 和 OpenAI 已扩大合作伙伴关系,将 ChatGPT Enterprise 部署到全球 120,000 名员工,以转变客户体验和内部运营。