✷ 归档 · 11 个实验室 · 3,048 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
在规模化环境下使用 vLLM x Mooncake 提供 Agentic 工作负载
vLLM 集成了 Mooncake 的分布式 KV 缓存存储,以提升 Agentic 大语言模型服务,在真实追踪上实现了 3.8 倍更高的吞吐量、46 倍更低的首次生成时间(TTFT)以及 8.6 倍更低的端到端延迟,并可扩展至 60 台 GB200 GPU。
Hugging Face 开放 ASR 排行榜:使用私有数据集对抗 Benchmaxxing
Hugging Face 在开放 ASR 排行榜中引入了来自 Appen Inc. 和 DataoceanAI 的私有评估数据集,以防止测试集污染并提供更可靠的真实场景 ASR 性能衡量。
OpenAI B2B 信号:前沿公司如何领先
OpenAI 推出 B2B Signals,揭示前沿公司(使用率位于第95百分位)现在每位员工使用的智能量是普通公司的 3.5 倍,驱动因素是复杂的代理式工作流。
OpenAI 推出 ChatGPT Futures:2026 届
OpenAI 已推出 ChatGPT Futures 项目,为使用 AI 构建工具、推动研究并创造社会影响的 2026 届学生提供资助和模型访问权限。
Singular Bank 集成 ChatGPT 和 Codex 以推出 Singularity 助手
Singular Bank 开发了 Singularity,这是一个由 ChatGPT 和 Codex 驱动的内部 AI 助手,通过自动化投资组合分析和沟通,使银行家每天的生产力损失减少 60 到 90 分钟。
Uber 与 OpenAI 集成:AI 驱动的司机指导与语音预订
Uber 正在整合 OpenAI 前沿模型,推出 Uber Assistant,以优化司机收入并通过语音预订降低乘客的使用摩擦。
Grok Imagine Quality Mode API 发布
xAI 为 Grok Imagine API 推出了 Quality Mode,为企业级开发者提供增强的真实感、改进的多语言文本渲染以及在图像生成和编辑方面卓越的创意控制。
xAI Grok Connectors 发布
xAI 推出了 Connectors,这是 Grok 在 web、iOS 和 Android 上的深度集成功能,允许 AI 在 Google Workspace、GitHub 和 Notion 等第三方应用程序中读取和写入数据。
xAI 与 Anthropic 计算伙伴关系
xAI 已与 Anthropic 建立伙伴关系,提供对 Colossus 1 超级计算机的访问权限,并计划进一步探索轨道 AI 计算能力。
Anthropic 通过 SpaceX 合作伙伴关系扩展计算能力并提高 Claude 使用限制
Anthropic 已与 SpaceX 建立合作伙伴关系以访问 Colossus 1 数据中心,从而为 Claude Code 和 Claude API 提供更高的使用限制。
GPT-5.5 Instant 系统卡
OpenAI 已发布 GPT-5.5 Instant 系统卡,标志着首次将 Instant 模型在网络安全和生物与化学防护类别中归类为高能力。
GPT-5.5 Instant 发布说明 / 新功能
OpenAI 已发布 GPT-5.5 Instant,作为 ChatGPT 的新默认模型,提升了事实准确性,降低了冗长程度,并通过更深入的用户上下文集成增强了个性化。
OpenAI MRC 多路径可靠连接协议
OpenAI 通过开放计算项目(Open Compute Project)发布了多路径可靠连接(MRC)协议,以提升大规模 AI 训练集群中 GPU 网络的弹性和性能。
OpenAI 欧洲青年安全蓝图与 EMEA 青年福祉资助
OpenAI 宣布了其欧洲青年安全蓝图以及首批 EMEA 青年福祉资助的受助者,以促进适龄 AI 使用并保护欧洲、中东和非洲的年轻人。
OpenAI 扩大 ChatGPT 广告试点,推出自助广告管理平台和 CPC 竞价
OpenAI 正在通过推出 beta 自助广告管理平台、按点击付费 (CPC) 竞价以及扩展的测量工具,来扩大其 ChatGPT 广告试点,使各类规模的企业更容易投放广告。
OpenAI 和 PwC 合作开展金融领域的 AI 代理
OpenAI 和 PwC 正在合作部署 AI 代理以自动化金融工作流程,利用 OpenAI 自身的金融组织作为测试环境,以现代化 CFO 办公室。
OpenAI 低延迟语音 AI 基础设施
OpenAI 通过采用分离的中继加收发器架构,重新设计了其 WebRTC 堆栈,以向超过 9 亿每周活跃用户提供低延迟、可扩展的语音 AI。
Anthropic 与 Blackstone、Hellman & Friedman 以及 Goldman Sachs 成立新的企业级 AI 服务公司
Anthropic 与 Blackstone、Hellman & Friedman 以及 Goldman Sachs 合作,推出了一家新的 AI 服务公司,专注于为中型组织部署 Claude。
Google DeepMind AI 协同临床医生研究计划
Google DeepMind 推出了 AI 协同临床医生研究计划,这是一套多模态 AI 系统,旨在在临床监督下通过证据综合和实时患者交互来支持医疗提供者。
Qwen-Scope 可解释性工具包发布
Qwen 发布了 Qwen-Scope,这是一款使用稀疏自编码器(SAE)将 Qwen3 与 Qwen3.5 系列模型的隐藏表征分解为可解释特征,以便进行模型优化的可解释性工具包。
OpenAI 高级账户安全发布
OpenAI 已推出高级账户安全,这是一个针对 ChatGPT 和 Codex 账户的可选设置,强制使用防钓鱼身份验证并禁用传统恢复方式,以保护高风险用户。
Anthropic Claude 个人指导研究揭示使用模式,并在 Opus 4.7 和 Mythos Preview 中减少奉承行为
Anthropic 宣布,约 6% 的 Claude 对话属于个人指导请求,而新推出的 Opus 4.7 和 Mythos Preview 模型将奉承性回应减少了一半,尤其是在人际关系建议方面。
xAI Custom Voices 发布
xAI 推出了 Custom Voices,允许用户通过一段简短的录音克隆自己的声音,以便在 Grok Text to Speech 和 Voice Agent APIs 中使用。
OpenAI 对模型行为的分析:‘妖精’词汇抽搐
OpenAI 发现,针对‘书呆子’人格功能的奖励信号导致 GPT-5.1 至 GPT-5.5 的模型形成了使用妖精和小恶魔隐喻的无意习惯,并且这种习惯进一步在其他模型行为中泛化。
IBM Granite 4.1 LLMs 发行说明 / 技术概览
IBM 发布了 Granite 4.1,这是一系列密集型、仅解码器的 LLMs(3B、8B、30B),通过严格的数据策划和多阶段强化学习管道实现高性能。
OpenAI Stargate 计算基础设施更新
OpenAI 已超额完成其在美国的 10GW AI 基础设施初始目标,并在其位于德克萨斯州阿比林的旗舰 Stargate 站点训练了 GPT-5.5。
OpenAI 智能时代网络安全行动计划
OpenAI 已推出一个五支柱行动计划,以民主化 AI 驱动的网络防御并增强对 AI 驱动威胁的韧性。
DeepInfra 与 Hugging Face 推理提供商集成
Hugging Face 已将 DeepInfra 添加为支持的推理提供商,使得可以直接通过 Hub 和客户端 SDK 访问超过 100 种模型的无服务器访问,包括 DeepSeek V4 和 Kimi-K2.6。
使用 BioMysteryBench 评估 Claude 的生物信息学研究能力
Anthropic 推出了 BioMysteryBench,这是一个全新的生物信息学基准测试,其中最新的 Claude 模型在表现上已能与人类专家并驾齐驱,并解决了若干人类专家无法解决的问题。
NVIDIA Nemotron 3 Nano Omni 发布说明 / 新特性
NVIDIA 发布了 Nemotron 3 Nano Omni,这是一款全模态模型,能够跨文本、图像、视频和音频进行长上下文推理,并在文档智能和视频理解基准测试中提供了业界领先的准确率。
FlashQLA:面向 CP / 反向友好的融合线性注意力内核(用于 GDN)
Qwen 开源了 FlashQLA,这是一款基于 TileLang 的高性能线性注意力内核库,在 NVIDIA Hopper GPU 上实现了对门控增量网络(GDN)层的 2-3 倍前向加速和 2 倍反向加速。
NVIDIA Nemotron 3 Nano Omni 在 vLLM 中的支持
vLLM 现在支持 NVIDIA Nemotron 3 Nano Omni,这是一款高效的 30B MoE 多模态模型,将视觉、音频和语言推理统一到单一循环中,为代理式 AI 提供动力。
OpenAI 社区安全与暴力缓解框架
OpenAI 已详细阐述其多层次方法,以防止 ChatGPT 被用于策划或执行暴力,结合了模型训练、自动检测和人工审查。
OpenAI GPT-5.5、Codex 与 AWS 上的托管代理发布说明
2026年4月28日,OpenAI 宣布其前沿模型(包括 GPT-5.5、Codex 编码代理以及由 OpenAI 提供动力的 Amazon Bedrock 托管代理)现已在 AWS 上以有限预览方式提供,使企业能够在其现有的 AWS 安全、合规和采购工作流中使用这些功能。
OpenAI 获得 FedRAMP 中等授权
OpenAI 已获得针对 ChatGPT Enterprise 和其 API 平台的 FedRAMP 20x 中等授权,使美国政府机构能够在符合联邦安全和隐私标准的前提下访问包括 GPT-5.5 在内的前沿 AI 模型。
Mistral AI Workflows 公测版
Mistral AI 已发布 Workflows 公测版,为企业级 AI 提供了一个编排层,确保生产环境下的 AI 流程具有持久性、可观测性和容错性。
Google DeepMind 与大韩民国的合作伙伴关系
Google DeepMind 已与韩国科学技术信息通信部达成合作,在首尔建立一个 AI Campus,并部署前沿 AI 模型,以加速生命科学、能源和气候领域的科学研究。
微软与OpenAI合作的下一阶段
OpenAI 与微软已修改合作协议,以提供更大的灵活性,允许 OpenAI 在任何云提供商上提供产品,同时仍将微软作为其主要云合作伙伴。
Choco 使用 AI 代理自动化食品分发
Choco 宣布了基于 OpenAI API 构建的 AI 驱动的 OrderAgent 和 VoiceAgent,以实现食品分发订单处理的自动化。
# OpenAI 隐私过滤器:构建可扩展的 PII 检测 Web 应用
OpenAI 已发布 Privacy Filter,这是一个开源的 15亿参数 PII 检测器,能够在 128k 上下文窗口中标记八类敏感数据。
Symphony: Codex 编排的开源规范
OpenAI 发布了 Symphony,这是一个开源规范,可将 Linear 等问题追踪器转变为 Codex 编程代理的常驻编排器,使团队能够自动化常规实现工作并提高 PR 吞吐量。
OpenAI 通用人工智能(AGI)开发的运营原则
OpenAI 已概述五个核心原则——民主化、赋能、韧性、普遍繁荣和适应性——以确保通用人工智能(AGI)造福全人类。
OpenAI AI 工作转型框架
OpenAI 推出了 AI 工作转型框架,以分析 AI 对 921 种职业就业的影响,根据自动化风险、重组、增长潜力和稳定性将工作划分为四条路径。
vLLM DeepSeek V4 支持:高效长上下文注意力
vLLM 现已支持 DeepSeek V4-Pro 和 V4-Flash,实现了一种新注意力机制,使上下文长度可达一百万 token,并显著节省 KV 缓存内存。
DeepSeek-V4 发布说明:为 AI Agent 提供高效的 1M-Token 上下文
DeepSeek-V4 引入了由混合 CSA/HCA 注意力机制驱动的 1M-token 上下文窗口,专门针对长程 Agent 工作负载和工具使用轨迹进行了优化。
DeepSeek-V4 Preview Release
DeepSeek 发布了开源的 DeepSeek-V4 preview,引入了两个模型变体——Pro 和 Flash——具有 1M token 上下文窗口和最先进的 agentic coding 能力。
Anthropic 与 NEC 在日本推进原生人工智能工程合作
Anthropic 与 NEC 合作,将 Claude 部署至 30,000 名 NEC 员工,并为日本的金融、制造和政府领域开发安全、行业专用的人工智能产品。
Anthropic 选举保障措施更新
Anthropic 已实施了一套全面的保障措施,包括中立性训练和自动化分类器,以确保 Claude 在 2026 年美国中期选举和其他全球选举期间保持公正且安全。
OpenAI GPT-5.5 发布说明
OpenAI 已发布 GPT-5.5 和 GPT-5.5 Pro,在保持 GPT-5.4 延迟不变的同时,显著提升了代理式编码、计算机使用和科学研究能力。
OpenAI GPT-5.5 系统卡
OpenAI 已发布 GPT-5.5,这是一个针对复杂真实世界任务和工具使用进行优化的模型,具有增强的任务理解能力和更强大的安全框架。