归档 · 11 个实验室 · 3,048 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

151

OpenAI 与 CodeAI 合作推出 ChatGPT for Teens 及 AI 素养计划

OpenAI 宣布与 CodeAI 合作推出 ChatGPT for Teens 以及一系列教育计划,旨在向高中生教授 AI 素养、批判性思维和负责任的使用方式。

152

OpenAI 为网络关键能力调整模型开发节奏

OpenAI 已暂时放缓了包括 Astra 在内的最新模型的规模扩展,以在发现关键网络安全能力证据后,实施加强的监控、对齐和安全保障措施。

153

Asana 使用 OpenAI Codex 加速遗留代码迁移

Asana 使用 OpenAI Codex 在两周内移除了一个过时的测试系统,完成了一个此前预计需要五年时间和 600 万美元的项目。

154

Sentence Transformers v6.0 多向量编码器发布

Sentence Transformers v6.0 增加了 MultiVectorEncoder 模型类型,用于实现 ColBERT 风格的晚期交互检索,可在文本、图像、音频和视频上实现逐标记嵌入,以更高的检索质量换取更大的索引空间。

155

NVIDIA ChatGPT Work 的实施应用

NVIDIA 使用 ChatGPT Work 来自动化运营流程并综合行业情报,从而减少手动分析时间并加速原型开发。

156

Claude 蛋白质设计与分析化学能力

Anthropic 证明了 Claude 模型可以自主设计高亲和力蛋白质结合剂,其命中率超过了人类专家,并能自动执行复杂的分析化学工作流,包括 NMR 和 LC-MS 数据处理。

157

Dharma AI GPU 管理:通过约束感知分配提高集群利用率

Dharma AI 开发了一种约束感知的 GPU 分配器,与在相同硬件上使用 FIFO 调度相比,该分配器将 GPU 利用率提高了多达 33 个百分点,并将优先级加权输出提高了多达 105%。

158

防御者的窗口:OpenAI 在 AI 驱动的网络安全领域的策略

OpenAI 在 OpenAI-Hugging Face 事件之后概述了一套全面的防御策略,以应对 AI 驱动的网络攻击,并强调了组织利用前沿智能实现安全程序自动化的紧迫性。

159

OpenAI 加入 PORTS-Pike 项目

OpenAI 正与 SB Energy、NVIDIA 和美国能源部合作,在俄亥俄州 PORTS-Pike Technology Campus 获得 8 GW-IT 的容量,以支持前沿 AI 训练和产品需求。

160

OpenAI 智能时代新政策构想资助计划

OpenAI 向 14 个专注于 AI 时代经济机会和社会韧性的全球独立项目提供 100 万美元的资金和 100 万美元的 API 额度。

161

vLLM-Omni 分布式层级卸载 (Distributed Layerwise Offload)

vLLM-Omni 引入了分布式层级卸载 (DLO),通过权重分片和双缓冲预取技术优化 HBM 和宿主机内存使用,从而实现对超过 200B 参数的大型 Diffusion Transformer (DiT) 模型的有效推理服务。

162

Claude 文本水印实现

Anthropic 正在为未来的 Claude 模型引入文本水印技术以符合 EU AI Act,采用的方法是在不影响输出质量的前提下,改变词汇选择中的随机性来源。

163

vLLM 使用 DSpark 进行自适应验证

vLLM 引入了使用 DSpark 置信度头的自适应验证,通过动态调整每步验证的投机标记数量,在不同的并发水平下保持高吞吐量。

164

2026 年夏季开源模型现状报告

Hugging Face 的 2026 年夏季报告显示,中国实验室目前在开源前沿模型的发布方面占据主导地位,小模型仍占据大部分下载量,Qwen 已成为社区的基础模型,而智能体已成为 Hub 的主要用户。

165

GitHub Copilot 中的 Grok 4.6

xAI 已将其最新的编程模型 Grok 4.6 集成到了 GitHub Copilot 中,使其可供使用 VS Code 和 GitHub 的开发者使用。

166

Strands 机器人与 LeRobot 流式数据循环结合 Hugging Face 存储桶

Hugging Face 宣布了一个完整数据循环,使 Strands 机器人能够记录 LeRobot 演示,将数据同步到具有字节级去重功能的可变 Hugging Face 存储桶,直接从 Hub 流式传输数据用于训练,并将生成的策略部署回硬件——整个过程无需本地下载。

167

Gemini 3.7 Flash 发布说明 / 更新内容

Google DeepMind 发布了 Gemini 3.7 Flash,这是一款针对编程和智能体优化的模型,在提供比 Gemini 3.6 Flash 显著性能提升的同时,将入门价格降低了一半。

168

Fyxer AI 行政助理技术实现

Fyxer 利用由 30-50 个专门的 OpenAI 模型组成的系统和 500,000 小时的人类助理工作流数据集,构建了一个具有高度上下文感知能力的 AI 行政助理,实现了 90% 的 90 天用户留存率。

169

GPT-5.6 发布说明:提升智能体性价比

OpenAI 发布了 GPT-5.6 模型系列,通过改进模型选择、用于推理连续性的新 API 控制以及程序化工具调用,显著降低了前沿级智能体性能的成本。

170

OpenAI GPT-5.6 Sol Ultrafast Mode Preview

OpenAI 为 GPT-5.6 Sol 推出了 Ultrafast 模式,这是一种由 Cerebras 提供支持的新服务层级,可提供高达每秒 750 个输出 token,比标准处理速度提高了多达 14 倍。

171

OpenAI 任命 Dali Rajic 为首席营收官

OpenAI 已任命 Dali Rajic 为首席营收官,旨在其每周活跃用户数突破 10 亿之际,扩展其全球营收组织。

172

Hugging Face ICML 2026 开放复现报告

Hugging Face 组织了一场社区黑客松,利用编程智能体复现了 2,226 篇 ICML 2026 论文,发现 51% 的论文至少有一个已验证的主张,而 23% 的论文至少有一个被判定为伪造或有争议的主张。

173

DeepSeek-V4-Pro GA 发布

DeepSeek 发布了 DeepSeek-V4-Pro,其特点是增强的智能体能力、灵活的推理力度设置以及对 OpenAI Responses API 的原生支持。

174

多智能体系统中的 Anthropic 模式与问题

Anthropic 研究揭示,虽然前沿模型可以在并行任务上进行协调,但在同伴级别的协作中表现挣扎,并因行为一致性表现出系统性失败,且在被赋予不兼容的目标时可能会升级为“领地战争”。

175

OlmoEarth Embeddings: Custom Vector Exports for Earth Observation

Hugging Face 和 AllenAI 推出了 OlmoEarth Studio 中的自定义嵌入向量导出功能,允许用户为下游地理空间分析生成地球观测数据的紧凑数值表示。

176

Google DeepMind SL2T: Pixel 11 的手语转文本翻译技术

Google DeepMind 推出了 SL2T,这是一种多语言手语转文本模型,可在 Pixel 11 的 Gboard 和 Live Transcribe 中实现手语转文本听写功能,首发支持美国手语 (ASL)。

177

LFM2.5-VL-3B 发布说明 / 更新内容

Liquid AI 发布了 LFM2.5-VL-3B,这是一款针对边缘设备优化的 3.1B 参数视觉语言模型,具有改进的屏幕理解、grounding 和工具调用能力。

178

OpenAI 企业级 AI 应用:从辅助到执行

OpenAI 报告称“前沿差距”正在扩大,排名前 10% 的企业用户通过从简单的 AI 辅助转向智能体化执行,生成的输出 Token 数量是典型企业的 8.3 倍。

179

vLLM Day 0 Support for Qwen3.8-2.4T-A95B

vLLM 宣布对 Qwen3.8-2.4T-A95B 提供 Day-0 支持,这是一个拥有 2.4 万亿参数的稀疏 MoE 模型,为开放权重版本带来了 Qwen-Max 级的能力。

180

RingCentral AI-Native Development and Operational Integration

RingCentral 已通过使用 ChatGPT Work 和 Codex 实施了 AI 原生工作流,以加速产品开发并实现技术和非技术人员在 PMO 运营中的自动化。

181

Anthropic 研究:评估工人再培训项目的证据

Anthropic 与研究员 David Roodman 发现,尽管职业再培训项目具有适度的积极影响,但它们可能不足以缓解人工智能引发的大规模劳动力市场动荡。

182

Grok 4.6 发布说明 / 更新内容

xAI 发布了 Grok 4.6,这是一个针对长时运行智能体、复杂编程和视觉化工作优化的模型,在 AA Intelligence Index 上与 GPT-5.6 Sol 持平。

183

ALTK-Evolve vs ACE:相同的经验,更少的 Token

ALTK‑Evolve 通过选择性指南检索而非注入完整 playbook,在仅使用 20-40% 推理 Token 的情况下,达到了与 ACE 持平或更高的任务完成准确率。

184

Mistral AI 主权 AI 基础设施与区域推理更新

Mistral AI 通过引入区域推理端点、支持第三方开源模型以及建立长期欧洲计算能力联盟,正在增强企业和政府的 AI 主权。

185

OpenAI Daybreak 模型现已在 AWS Bedrock 上可用

OpenAI 宣布其 Daybreak 网络安全模型,包括 Daybreak Blue(通用前沿模型,如 GPT-5.6 Sol)和 Daybreak Red(专用训练的安全模型),现已可通过 Amazon Bedrock 访问,使企业能够在其现有的 AWS 工作流中集成先进的 AI 驱动的安全能力。

186

NVIDIA Nemotron 3.5 Lightning 发布

NVIDIA Nemotron 3.5 Lightning 是一款拥有 300 亿参数的开源模型,每个 token 的激活参数为 30 亿,专为本地智能体工作流和具有 100 万 token 上下文窗口的多步任务而设计。

187

xAI Grok Bot 发布

xAI 推出了 Grok Bot,这是能够操作其专用云端计算机的 AI 队友,可以在各种应用程序和工具中执行端到端的任务,而无需 API。

188

Anthropic 构建高效 AI Agent —— 实用的模式与指南

Anthropic 概述了构建 LLM 增强型 Agent 和工作流的实用模式,强调了简单的可组合设计、何时使用每种模式以及工具工程的最佳实践。

189

Anthropic Claude Sonnet 5 发布公告

Anthropic 发布了 Claude Sonnet 5,这是一个更具智能体能力的、更具成本效益的模型,在提高安全性的同时,其性能可以媲美 Opus 级模型。

190

OpenAI AI-Native 财务职能实现

OpenAI 正在重新设计其财务运营,通过将 AI 集成到核心工作流中并赋能财务专业人员构建自己的工具,来实现零日结账和持续预测。

191

NVIDIA Magpie TTS 多语言版本发布

NVIDIA 发布了 Magpie TTS Multilingual,这是一个拥有 364M 参数的开源权重模型,支持 12 种语言,旨在为低延迟、生产就绪的语音智能体提供支持。

192

OpenAI 在德克萨斯州负责任 AI 基础设施的提案

OpenAI 已向德克萨斯州州长 Greg Abbott 发送了一封信函,概述了其在州内开发负责任 AI 基础设施的承诺,以确保为德克萨斯州人带来有意义的利益。

193

Model ML 与 GPT-5.6 Sol 用于金融工作流自动化

Model ML 利用 GPT-5.6 Sol 实现端到端金融工作流的自动化,与之前的模型相比,显著提高了 PowerPoint 和 Excel 交付物的专业就绪率。

194

大语言模型的高效知识蒸馏:离线 Top-K Logits 与融合分块 KL 损失

Multiverse Computing 推出了一种内存高效的蒸馏方法,通过使用离线 Top-K Logit 缓存和融合分块 KL 损失,显著降低了大语言模型的 VRAM 需求和训练成本。

195

OpenAI Daybreak 网络安全合作伙伴计划

OpenAI 已推出 Daybreak 网络安全合作伙伴计划,为安全合作伙伴提供访问前沿网络安全模型的权限,以帮助组织更高效地发现和修复漏洞。

196

OpenAI Daybreak 与 GPT-5.6-Cyber 发布

OpenAI 扩展了 Daybreak 项目并推出了 GPT-5.6-Cyber,这是一款专门设计的模型,旨在为受信任的防御者提供先进的网络安全网络安全能力,并减少在授权安全研究中的任务拒绝率。

197

Meta Muse Glimmer 30B 发布

Meta 发布了 Muse Glimmer,这是一个从 Muse 模型蒸馏而来的 30B 参数多模态模型,并基于 Apache 2.0 许可发布,针对编程和文档分析等本地智能体使用场景进行了优化。

198

ChatGPT Business Premium Seats 发布

OpenAI 为 ChatGPT Business 推出了 Premium 席位,为高容量需求用户提供 5 倍的使用量并取消了五小时使用限制。

199

维珍航空整合 ChatGPT Work

维珍航空正在利用 ChatGPT Work 来加速竞品研究、统一客户旅程数据并简化产品规划,以提升端到端的乘客体验。

200

Zapier 使用 ChatGPT Work 实现营销自动化

Zapier 的企业营销团队使用 ChatGPT Work 来自动化潜在客户漏斗优化和活动执行,从而实现了七位数的月度流水线增长。