归档 · 11 个实验室 · 3,048 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

501

OpenAI 前沿人工智能民主治理蓝图

OpenAI 发布了一份蓝图,提出一个三部分联邦框架,供美国通过国家标准化、加强 CAISI 和全政府韧性计划来治理日益强大的 AI 系统。

502

OpenAI Public Policy Agenda

On June 3, 2026, OpenAI released its public policy agenda outlining its mission, principles, and policy priorities across safety, youth protection, education, workforce transition, deepfakes, and AI infrastructure.

503

vLLM 快速且高效的 LLM 推理课程上线

vLLM 与 DeepLearning.AI 及 Red Hat 合作推出了一门名为 Fast & Efficient LLM Inference with vLLM 的免费中级课程,旨在教授完整的 AI 部署生命周期。

504

Hugging Face 速率限制阻止访问 'Adding MCP Tools to Reachy Mini' 文章

Hugging Face 指向博客文章 'Adding MCP Tools to Reachy Mini' 的链接返回 429 速率限制错误,因此无内容可供摘要。

505

Anthropic 攻击导航器:映射人工智能赋能的网络威胁并引入 ARiES 风险评分

Anthropic 发布了攻击导航器,一项将 832 个由人工智能赋能的威胁行为者映射到 MITRE ATT&CK 的研究,揭示中等或更高风险行为者比例增长了 1.7 倍,并引入了人工智能风险赋能评分(ARiES)以量化人工智能增强的网络风险。

506

xAI Grok Voice 与 Vapi 的集成

xAI 已与 Vapi 合作,将 Grok 设为 Vapi 12 种核心语音的默认引擎,为超过 250 万个语音代理提供增强的自然度和情感范围。

507

xAI Grok Imagine 1.5 预览版发布

xAI 发布了 grok-imagine-video-1.5-preview,这是一款通过 xAI API 将单张静态图像转换为最高 720p 电影级视频的图像转视频模型。

508

Anthropic Claude Partner Network: Services Track and Partner Hub

Anthropic 推出了 Services Track 和 Partner Hub,旨在通过提供分层认证系统和公开目录,帮助企业识别合格的 Claude 实施合作伙伴。

509

Anthropic 对 AI 赋能的网络威胁分析 (2025-2026)

Anthropic 对 832 个被封禁账号的分析显示,AI 正在使技术水平较低的行为者能够执行复杂的入侵后活动,并创建当前的 MITRE ATT&CK 等安全框架无法捕捉的自主攻击链。

510

Holo3.1: 快速 & 本地计算机使用代理

由于 429 速率限制错误,提供的 Holo3.1 源材料不可用,且未提供任何技术细节。

511

Travelers 部署由 OpenAI 驱动的 AI 理赔助手

Travelers 已经推出了一个由 OpenAI 的 Realtime API 驱动的全国范围的 AI 理赔助手,以自动化汽车财产损害索赔的首次损失通知,使得 85-90% 的用户能够自主完成理赔申报。

512

ChatGPT Sites: 通过 Codex 创建内部页面和轻量级应用

OpenAI 已推出 ChatGPT Sites,这是一项功能,允许用户直接从 Codex 桌面应用创建、部署和共享内部网站和轻量级交互式应用。

513

Codex 适用于每种角色、工具和工作流程

OpenAI 宣布为 Codex 推出新的角色特定插件、交互式站点和就地注释,将其使用范围扩展到开发者以外的分析师、市场人员、销售、投资者和银行家。

514

OpenAI 青少年 AI 安全提案与全球领导倡议

OpenAI 提出建立国际青少年安全研究所及九点适龄 AI 保护框架,以供 G7 领导人峰会讨论。

515

OpenAI Codex 向知识工作领域的扩张

OpenAI 报告称,Codex 的周活跃用户已达到 500 万,其中知识工作者目前占用户群的 20%,且增长速度比开发者快三倍。

516

vLLM 会话感知代理路由(SAAR)发布

vLLM 引入了会话感知代理路由(SAAR),这是一种模型选择策略,通过在工具循环和提供者状态转换期间防止不安全的模型切换,以保持会话连续性并降低长时程 LLM 代理的成本。

517

vLLM-Omni 通过 AutoRound 量化加速推理

vLLM-Omni 现在集成了 Intel 的 AutoRound 训练后量化技术,实现了 W4A16 量化,在保持准确性的同时将模型大小缩减高达 62%,并解锁了在 Intel XPU 和 NVIDIA GPU 上的性能增益。

518

Anthropic 正在扩大 Project Glasswing 的规模

Anthropic 正在将 Project Glasswing 扩展到 150 家新组织,利用 Claude Mythos Preview 来保护关键基础设施,旨在在强大的、具备网络攻击能力的 AI 模型广泛发布之前,建立新的网络安全规范。

519

OpenAI 政策和政治倡导立场

OpenAI 已澄清,它不为政治行动委员会或候选人提供资金,并坚持认为 AI 政策应由广泛的利益相关者联盟塑造,而非单一组织。

520

JetBrains Mellum2 发布

JetBrains 宣布发布了 Mellum2,这是一款 12B Mixture-of-Experts(MoE)模型,但提供的源材料是错误页面,未包含任何技术细节。

521

超越 LLM:为什么可扩展的企业级 AI 采用取决于智能体逻辑 – 摘要

由于无法检索 Hugging Face 关于“Beyond LLMs: Why Scalable Enterprise AI Adoption Depends on Agent Logic”的文章,因此无法对其技术细节进行摘要。

522

OpenAI Stargate:密歇根的 Barn 数据中心

OpenAI 已在密歇根州萨林启动了 The Barn 项目——一个 1GW 数据中心园区,作为其 Stargate 计划的一部分,以扩展 AI 基础设施并支持美国再工业化。

523

OpenAI 前沿模型和 Codex 现已在 AWS 上提供

OpenAI 已将其前沿模型和 Codex 集成到 AWS,使企业能够使用现有的 AWS 安全、合规和计费工作流部署 OpenAI 能力。

524

Qwen3.7-Plus 发布说明 / 新功能

Qwen3.7-Plus 是一种多模态代理模型,将视觉和语言统一,使其能够在 GUI 和 CLI 环境中运行,以实现复杂的软件工程和生产力自动化。

525

vLLM 在 DGX Spark 上:架构、配置与本地评估

vLLM 为 NVIDIA DGX Spark 提供高性能的本地推理端点,利用统一内存架构和兼容 OpenAI 的 API,实现了包括 Nemotron-3-Super 在内的大型 NVFP4 模型的部署。

526

OpenAI 打断‘数据中心潮流’影响行动

OpenAI 禁止了一批与中国关联的账户,这些账户使用 `ChatGPT` 生成社交媒体内容和运营计划,旨在影响美国受众关于 AI 电力需求的看法,并骚扰中国异议人士。

527

OpenAI 打击与中国关联的“技术与关税”影响行动

OpenAI 禁止了一批由中国关联行为者使用的 ChatGPT 账户,这些账户用于生成亲中叙事、批评美国科技政策,并试图通过虚假数据泄露声明抹黑 OpenAI。

528

xAI Composer 2.5 发布

xAI 发布了 Composer 2.5,这是一款集成在 Grok Build 中的快速、先进的编码模型,专为长时间运行的任务和复杂的指令遵循而设计。

529

Anthropic 机密提交拟议 IPO 的 S-1 草案

Anthropic, PBC 已向美国证券交易委员会机密提交了 Form S-1 表格的注册登记声明草案,拟对其普通股进行首次公开募股 (IPO)。

530

Braintrust 对 OpenAI Codex 的集成

Braintrust 使用 OpenAI Codex 将客户功能请求在几分钟内转化为可运行的代码预览,显著加快了其开发反馈循环。

531

波士顿儿童医院 AI 集成与罕见疾病诊断

波士顿儿童医院已集成企业 AI 层,以优化运营并诊断超过 40 种先前未解决的罕见疾病。

532

Qwen-VLA:统一具身智能的视觉-语言-动作建模

Qwen-VLA 是一种通用的视觉-语言-动作模型,将机器人操作、视觉-语言导航以及跨具身控制统一为单一的通用策略模型。

533

OpenAI Rosalind 生物防御与 GPT-Rosalind 扩展

OpenAI 已启动 Rosalind 生物防御计划,并扩大了对 GPT-Rosalind 的受信任访问,以供政府和盟国合作伙伴使用,以加速生物防御和大流行防护工具的开发。

534

PyTorch 性能分析:torch.profiler 初学者指南

Hugging Face 提供了使用 torch.profiler 识别瓶颈、了解 CPU-GPU 调度链以及分析 torch.compile 对内核执行影响的完整指南。

535

OpenAI 分享了用于可信第三方前沿 AI 模型评估的指南手册

OpenAI 发布了一份共享的指南手册,解释了第三方评估者应如何选择 harness、引出能力以及检查有效性,以产生对前沿 AI 模型的可信评估。

536

xAI Grok Build 0.1 API 发布

xAI 已发布 grok-build-0.1,这是一个专为代理式任务(如网页开发和调试)优化的编码模型,可通过 xAI API 在公开测试版中使用。

537

Mistral AI Now Summit 2026 公告

Mistral AI 推出了面向工业工程的专用 AI stack,用于长周期生产力的 Vibe agent,以及位于法国 Les Ulis 的新型 10 MW 数据中心。

538

Mistral AI Vibe 发布说明

Mistral AI 推出了 Vibe,这是一款统一的 AI 智能体,集成了 Web、移动端、IDE 和 CLI 界面下的工作和编码工作流。

539

Endava 的 OpenAI Codex 代理组织策略

Endava 通过使用 OpenAI Codex 编码高级架构专业知识并将软件交付生命周期从几周压缩到几天,已转变为代理组织。

540

Mistral AI Search Toolkit 公测版

Mistral AI 已发布 Search Toolkit 公测版,这是一个开源的可组合框架,旨在将摄取、检索和评估统一到 AI 应用的单一生产级搜索流水线中。

541

Speculators v0.5.0 发行说明 / 新功能

Speculators v0.5.0 引入了 DFlash 算法支持,用于单次通过草稿令牌生成,通过 vLLM 原生隐藏状态提取统一了在线和离线训练,并提供了更新的文档。

542

vLLM 语义路由器多模态路由和视觉编码器加固

vLLM 为语义路由器(VSR)引入了多模态路由,使得系统能够将视觉证据作为请求级策略决策的一等信号使用,同时解决了 Rust/Candle 与 PyTorch 路径之间的关键实现漂移。

543

Laguna XS.2 使用 vLLM、Speculators 和 LLM Compressor 进行推理优化

Poolside 和 Red Hat AI 使用 vLLM 集成、DFlash 推测解码和 LLM Compressor 量化,对 Laguna XS.2 33B-A3B MoE 模型进行了优化,以适用于 agentic 编码任务。

544

vLLM 原生 RL API 发布

vLLM 已引入原生权重同步 API 并改进了异步 RL 支持,以标准化训练和推理之间的权重传输,并在大规模 DPEP 部署中消除死锁。

545

OpenAI 前沿治理框架

OpenAI 推出了前沿治理框架,以使其安全和安保实践符合新兴的法律要求,如欧盟《人工智能法案》和加州《前沿人工智能透明度法案》。

546

Anthropic 系列 H 轮融资与估值更新

Anthropic 已完成 650 亿美元的系列 H 轮融资,投后估值达 9650 亿美元,旨在扩大计算能力并加速人工智能安全研究。

547

OpenJarvis 1.0 发布:通过 Ollama 实现本地优先的个人 AI

OpenJarvis 1.0 是一个用于构建本地优先个人 AI 智能体的开源框架,它集成了 Ollama,可以在个人硬件上运行模型。

548

Mistral AI Physics AI 发布公告

Mistral AI 已集成 Emmi AI 以推出 Physics AI,这是一类数据驱动的模型,通过在几秒钟而非数小时或数周内预测物理行为,从而加速工业工程。

549

Mistral AI 物理 AI 研究与 Emmi AI 收购案

Mistral AI 正通过收购 Emmi AI 以及为航空航天、汽车、半导体和能源领域开发基础物理 AI 模型来推动工业工程的发展。

550

Cisco 和 OpenAI Codex 企业集成

Cisco 将 OpenAI 的 Codex 集成到其生产工程工作流程中,将特性开发时间从几个季度缩短到几周,并实现了缺陷解决吞吐量提高 10-15 倍。