归档 · 11 个实验室 · 3,048 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

351

Anthropic 宪法分类器:防御通用越狱攻击

Anthropic 宣布推出宪法分类器,这是一种新的输入-输出过滤系统,在仅增加适度计算开销和 0.38% 的无害拒绝率的情况下,将通用越狱成功率降至 5% 以下。

352

OpenAI 国家安全原则与政府合作

OpenAI 已发布其国家安全原则,以提供公司在政府合作以及技术在国家安全和执法中的使用方式的透明度。

353

OpenAI 对 SWE-Bench Pro 编码评估缺陷的分析

在一次审计揭示约 30% 的基准任务因过于严格的测试和描述不明确的提示等问题而损坏后,OpenAI 撤回了对 SWE-Bench Pro 的推荐。

354

Robostral Navigate 发布说明

Mistral AI 推出了 Robostral Navigate,一个 8B 参数的模型,使机器人仅通过单个 RGB 摄像头即可自主导航复杂环境,在未见的 R2R-CE 基准测试中达到 76.6% 的成功率。

355

OpenAI Academy K–12 教育工作者 AI 技能研讨会

OpenAI Academy 与沃尔顿家族基金会合作,推出 AI 技能研讨会,为超过 1,600 名 K–12 教育工作者提供动手培训,帮助他们将 AI 融入教学和行政管理。

356

Hugging Face 原生速度 vLLM Transformers 建模后端

Hugging Face 通过在运行时动态应用推理专用的层融合,更新了 transformers vLLM 后端,使其吞吐量能够匹配或超过自定义 vLLM 实现。

357

介绍 GPT‑Live‑1 和 GPT‑Live‑1 mini:OpenAI 的全双工语音模型

OpenAI 宣布推出 GPT‑Live‑1 和 GPT‑Live‑1 mini,这两款全双工语音模型实现自然、可打断的对话,并将复杂推理委派给 GPT‑5.5,现已在全球范围内向 ChatGPT 用户推出。

358

Anthropic 和 AE Studio 推出用于双重用途知识控制的 GRAM

Anthropic 和 AE Studio 开发了梯度路由辅助模块 (GRAM),这是一种将双重用途知识隔离到可移除的分隔区中的方法,旨在防止滥用而不牺牲通用模型的性能。

359

Hugging Face 与 Amazon SageMaker Studio 集成

Hugging Face 推出了与 Amazon SageMaker AI 的深度链接集成,使开发者能够通过一次点击,从模型发现直接进入 SageMaker Studio 进行微调或部署。

360

Foundry 托管计算上的 Hugging Face 模型

Microsoft Foundry 现在整合了一个经过策划、每周刷新的 Hugging Face 开放权重模型目录,可以通过一键部署到 Foundry 托管计算上,以实现企业级运营化。

361

智能是免费的,现在怎么办?面向代理、由代理构建以及由代理驱动的数据系统

BAIR 研究者提出了一种新框架,用于在 AI 推理成本趋近于零时,重新设计数据系统以适应代理工作负载、代理状态管理以及代理驱动的系统合成。

362

Hugging Face 和 SkyPilot 集成以实现零弹出 AI 存储

Hugging Face 和 SkyPilot 已集成,使 AI 工作负载能够在任何云提供商上运行,并且读取存储在 Hugging Face Hub 上的模型和数据集时产生零弹出费用。

363

MUFG AI 原生转型与 OpenAI

MUFG 正与 OpenAI 合作,为 35,000 名员工实施 ChatGPT Enterprise,并开发 AI 驱动的客户体验,以转型为 AI 原生金融集团。

364

澳大利亚支付Plus整合ChatGPT Enterprise和Codex

澳大利亚支付Plus(AP+)已部署ChatGPT Enterprise和Codex以加速技术调查、简化复杂知识工作,并将产品原型时间从几周缩短到一天。

365

LeRobot v0.6.0 release notes / what's new

LeRobot v0.6.0 引入了世界模型策略、扩展的 VLA 模型库、统一的奖励模型 API,以及具有 DAgger 式人机回环纠正功能的新部署 CLI。

366

PRX 数据策略:通过 VLM 重新标注和 Mosaic 流式传输扩展预训练

Photoroom 详细说明了 PRX 的数据管道,强调使用长 VLM 生成的标注、混合 Lance 和 Mosaic 数据碎片存储策略以及高质量 JPEG 编码,以优化一个 7B 参数模型。

367

vLLM × HPC-Ops:来自腾讯混元的高性能注意力和 MoE 后端

vLLM 现已集成针对 NVIDIA Hopper H20 优化的 HPC-Ops 注意力和 MoE 后端,实现最高 2.95 倍的注意力加速和 1.59 倍的 MoE 加速,在 Hy3 上将 TTFT 降低约 24%,TPOT 降低约 17%。

368

Hugging Face Kernels 重大更新

Hugging Face 宣布其 Kernels 项目的重大更新,引入了新的 kernel 仓库类型、受信任的发布者和代码签名、改造的 CLIs、更广泛的框架支持以及面向代理的 kernel 开发基础。

369

Anthropic 在 Claude 语言模型中发现了一个全局工作空间 (J-space)

Anthropic 宣布在 Claude 中发现了一个涌现的“J-space”,其功能作为内部、可报告推理的全局工作空间,从而实现了沉默思想的监控以及新的安全工具。

370

Alberta Government Uses Claude Code to Scan and Fix 466M Lines of Code in Hours

阿尔伯塔省政府部署了 Anthropic 的 Claude Code (Opus and Sonnet) 在 20 小时内扫描了 3,400 个仓库中的 4.66 亿行代码,自动生成修复方案,并建立了持续的 AI 驱动安全审查,大幅缩短了原本需要数年的任务时间。

371

xAI Grok Voice 更新:21 种全新旗舰级语音

xAI 为 Grok Voice 发布了 21 种全新的多语言旗舰级语音,同时改进了原有的五种语音,并推出了 Grok Voice Agent Builder。

372

Google DeepMind 和 A24 研究合作伙伴关系

Google DeepMind 和 A24 已建立研究合作伙伴关系,以将人工智能创新直接融入创意过程,以开发新的电影制作工作流程和技术。

373

Leanstral 1.5 发布:最先进的形式化验证模型

Mistral AI 发布了 Leanstral 1.5,这是一个拥有 119 B 参数、采用 Apache‑2.0 许可证的模型,它在 miniF2F 上达到饱和,解决了 587/672 个 PutnamBench 问题,并在开源代码中发现了此前未知的漏洞。

374

Claude Fable 5 网络安全防护措施与越狱框架

Anthropic 详细说明了 Claude Fable 5 中用于防止网络安全误用的安全分类器,并提出了一个新的网络越狱严重程度 (CJS) 框架,以标准化 AI 越狱的评估方式。

375

Anthropic 恢复对 Claude Fable 5 和 Mythos 5 的访问

Anthropic 宣布,在美国出口管制解除后,Claude Fable 5 和 Mythos 5 已恢复上线,详细介绍了新的安全分类器、行业级越狱严重性框架以及与政府的扩展合作。

376

Claude Fable 5 和 Claude Mythos 5 正式发布 – 搭载安全防护机制的先进 Mythos 类模型,支持分级访问

Anthropic 发布了 Claude Fable 5,一款在软件工程、视觉和科学领域均创下记录性能的通用型 Mythos 类 1 模型,以及 Claude Mythos 5,一款为可信网络安全专家和未来生物研究伙伴提供的放宽安全限制版本。

377

BAIR 2026 毕业生展示

伯克利人工智能研究(BAIR)实验室宣布了其2026届博士毕业生,突出了机器人、大型语言模型、AI安全和医疗保健方面的研究。

378

Hugging Face 和 Cerebras 使用 Gemma 4 的实时语音 AI

Hugging Face 和 Cerebras 开发了一个使用 Gemma 4 31B 的开放级联语音到语音管道,以实现自然的低延迟语音 AI 交互。

379

vLLM-Omni 为 Qwen3-Omni-30B-A3B-Instruct 推理服务的优化方案

vLLM-Omni 通过 Thinker、Talker 和 Code2Wav 的三阶段流水线提供 Qwen3-Omni-30B-A3B-Instruct 服务,并通过阶段分解、CUDA Graphs、异步分块交接、异步输出、阶段副本和热路径清理提升了吞吐量和延迟。

380

xAI Voice Agent Builder Beta Release

xAI 推出了 Voice Agent Builder 的测试版,这是一个由 Grok Voice 提供支持的、用于创建生产级语音代理的无代码平台。

381

ScarfBench: 用于企业 Java 框架迁移的 AI Agent 基准测试

IBM Research 推出 ScarfBench,一个开放的基准,用于评估 AI Agent 迁移企业 Java 应用跨 Spring、Jakarta EE 和 Quarkus 框架的能力。

382

Nano Banana 2 Lite 与 Gemini Omni Flash 发布

Google DeepMind 发布了用于高速、高性价比图像生成的 Nano Banana 2 Lite,以及用于高质量视频生成和对话式编辑的 Gemini Omni Flash。

383

为什么专业化在 AI 系统中是不可避免的

基于 Goldfeder 等人 2026 年的研究,专业化是 AI 性能的结构性必要条件,因为有限的资源使得集中能力比广泛的通用性更有效。

384

OpenAI Signals: 全球 ChatGPT 采用趋势分析

OpenAI Signals 数据表明,ChatGPT 使用在全球范围内正在深化和扩展,用户在注册六个月后每日消息量增加 50%,执行的任务种类翻倍。

385

Anthropic Frontier Red Team:压力测试人工智能能力

Anthropic 的 Frontier Red Team 通过对人工智能在网络安全、国家安全和自主系统方面的影响进行基于证据的分析,以预测未来风险。

386

Hugging Face 社区评估与 Every Eval Ever (EEE) 集成

Hugging Face 已将社区评估与 Every Eval Ever (EEE) 项目集成,实现标准化评估结果的跨平台发布,并在模型页面与详细技术记录之间建立直接链接。

387

OpenAI 核心转储流行病学:修复一个 18 年前的 libunwind 错误

OpenAI 在其 Rockset 数据基础设施中识别并解决了两种不同的崩溃人群,包括一次静默硬件故障和 GNU libunwind 中罕见的 18 年前竞争条件。

388

OpenAI 推出 GeneBench-Pro 用于计算生物学推理

OpenAI 已发布 GeneBench-Pro,这是一个研究级基准,旨在评估 AI 代理在计算生物学中的高级科学判断和迭代分析能力。

389

Inside Genebench-Pro: 基因组 AI 基准测试的案例研究

OpenAI 的 Genebench-Pro 提供了一个专门的基准,用于评估 AI 模型在复杂基因组任务上的表现,涵盖体细胞肿瘤学、功能基因组学和种群遗传学中的十个详细案例研究。

390

Claude Science AI 工作台发布

Anthropic 推出了 Claude Science,这是一个集成科学工具、管理可扩展计算并提供可审计研究成果的 AI 工作台,旨在加速科学发现。

391

TITLE: DiScoFormer: 用于密度和得分的单一Transformer,跨越分布

SUMMARY: DiScoFormer 是一种新的基于Transformer的模型,能够在一次前向传播中从一组数据点估计分布的密度和得分,而无需为新分布重新训练模型。

392

OpenAI 绘制欧洲 AI 劳动力机遇报告 2026

OpenAI 的 2026 年报告将其 AI 职业转型框架扩展到欧盟,发现约 12% 的欧盟就业可能因 AI 而增长,14% 面临更高的近期自动化潜力,27% 可能重组,47% 的变化不那么迫切。

393

vLLM Semantic Router: 通过微智能体协作提升模型性能

vLLM 引入了 Semantic Router,这是一个服务层原语,它将单个模型 API 调用转换为微智能体的有限协作,以在复杂基准上超越前沿模型。

394

Ollama 0.31: 通过多 Token 预测实现更快的 Gemma 4 性能

Ollama 0.31 在 Apple Silicon 上为 Gemma 4 引入了多 Token 预测技术,在不改变模型输出的情况下,使编码代理基准测试中的 Token 生成速度提升了近 90%。

395

HP Inc. 和 OpenAI 战略合作伙伴关系

HP Inc. 正在使用 OpenAI Frontier 平台扩大其与 OpenAI 的战略合作伙伴关系,以在客户支持、安全和软件开发领域部署 AI 代理和工作流。

396

GPT-5.6 Sol 预览:功能、防护措施和可用性

OpenAI 预览了 GPT-5.6 Sol,其旗舰下一代模型,与 Terra 和 Luna 一同发布,强调了增强的编码、生物学和网络安全能力,配备增强的防护措施,并面向可信合作伙伴进行有限发布。

397

Hugging Face Jobs: 使用单个命令部署 vLLM 服务器

Hugging Face 现在允许用户通过 HF Jobs 使用单个命令在其基础设施上部署私有的 OpenAI 兼容 vLLM 端点,为测试、评估和批量生成提供了一种按秒计费的替代方案。

398

Anthropic 经济指数周期报告 – 2026 年 6 月

Anthropic 2026 年 6 月的经济指数报告揭示,Claude 的使用模式如今遵循每日和每周的工作节奏,生成的输出价值更高且消耗更多计算资源,而自动化程度更高的用户对人工智能对其工作影响的预期出人意料地乐观。

399

OpenAI Codex 代理 AI 采用与影响

OpenAI 报告称,通过 Codex,知识工作从短暂的聊天机器人互动转向长期的代理 AI 任务,非开发者采用率自 2025 年 8 月以来增长了高达 189 倍。

400

Gemini 3.5 Flash 计算机使用集成

Google DeepMind 将计算机使用作为原生工具集成到 Gemini 3.5 Flash 中,使代理能够在浏览器、移动设备和桌面环境中看到、推理并采取行动。