151

OpenAI 学院课程:工作中的 AI 采纳

OpenAI 已推出三门新课程——AI 基础、应用 AI 基础和代理与工作流——帮助组织建立 AI 流畅度,并从单个任务改进转向结构化的、由代理协助的工作流。

152

MiniMax M3 vLLM 支持:面向 1M Token 多模态推理的 Day-0 部署

vLLM 已发布对 MiniMax M3 系列模型的 Day-0 支持,借助 MiniMax Sparse Attention (MSA) 实现高效的 1M Token 上下文服务和原生多模态推理。

153

Preply 与 OpenAI:用 AI 个性化语言学习

Preply 已集成 OpenAI API,打造课程洞察工具,将 1:1 人工辅导课程转化为通过自动化反馈和针对性练习实现的个性化学习旅程。

154

PyTorch 性能分析(第 2 部分):从 nn.Linear 到融合的 MLP

摘要:Hugging Face 解释了如何通过分析 GPU 内核融合、`torch.compile` 的影响以及使用 `kernels` 库的手工调优内核来优化 PyTorch 中的多层感知机(MLP)。

155

OpenAI 收购 Ona 以实现 Codex 持久云执行

OpenAI 正在收购 Ona,将安全云执行和编排技术整合到 Codex 中,使 AI 代理能够独立于用户的活跃会话,执行复杂且长期的任务。

156

OpenAI 支持欧盟关于 AI 生成内容透明度的行为准则

OpenAI 已宣布支持欧盟委员会关于 AI 生成内容透明度的行为准则,以实施欧盟 AI 法案并提升数字来源可追溯性。

157

使用 OpenAI Codex 加速黑洞等离子体模拟

天体物理学家 Chi-kwan Chan 正在使用 OpenAI Codex 推导和测试新的数值算法,以减少模拟黑洞周围粒子运动的计算开销。

158

BBVA 与 OpenAI 就 AI 原生银行业务达成战略合作

BBVA 已与 OpenAI 建立战略联盟,旨在将其全球业务中的人工智能进行整合,将 ChatGPT Enterprise 的应用规模扩大到 100,000 名员工,并实施了名为“The Eight”的全面 AI 转型路线图。

159

OpenAI 和 Oracle Cloud Infrastructure 集成

OpenAI 和 Oracle 正在合作,以允许 Oracle Cloud Infrastructure (OCI) 客户将符合条件的 Oracle Universal Credits 用于 OpenAI 前沿模型和 Codex。

160

DiffusionGemma: 通过文本扩散实现4倍更快的文本生成

Google DeepMind 已发布 DiffusionGemma,这是一个实验性的 26B MoE 模型,利用文本扩散同时生成文本块,相比自回归模型在专用 GPU 上实现最高 4 倍更快的推理。

161

OpenAI 破坏与 PRC 关联的影响行动,针对美国 AI 辩论

OpenAI 已封禁两组与中国相关的 ChatGPT 账户簇,这些账户利用 AI 秘密操纵美国关于 AI 基础设施和技术政策的公众辩论。

162

Google DeepMind 多智能体 AI 安全研究资助呼吁

Google DeepMind 及其合作伙伴宣布了一项 $10M 资助呼吁,以研究大规模多智能体 AI 系统的安全性和稳定性,以减轻由相互作用的独立智能体产生的新兴风险。

163

LSEG 通过 OpenAI 集成扩展可信 AI

伦敦证券交易集团(LSEG)已集成 ChatGPT Enterprise 和 OpenAI API,将产品发布周期从月份缩短至周,并提升全球员工生产力。

164

DiffusionGemma: 首个在 vLLM 中获得原生支持的 Diffusion LLM

vLLM 已集成 DiffusionGemma,这是一个 26B 参数的离散扩散语言模型,通过迭代式地对 Token 块进行去噪而非顺序自回归解码,实现了高吞吐量、低延迟的生成。

165

Gemini 3.5 Live Translate 发布说明

Google DeepMind 发布了 Gemini 3.5 Live Translate,这是一款音频模型,可为 70 多种语言提供近乎实时的语音对语音翻译,同时保留说话者的语调和音高。

166

Gemma 4 12B 发行说明 / 新功能

Google DeepMind 已发布 Gemma 4 12B,这是一个专为在配备 16GB RAM 的笔记本电脑上本地执行而设计的无编码器多模态模型,具备原生音频和视觉处理能力。

167

Google DeepMind 加速器:机器人项目启动

Google DeepMind 在欧洲推出了一个机器人加速器,选拔了 15 家早期机器人初创公司,以获得三个月的技术支持和访问 Gemini 机器人模型的机会。

168

Nextdoor 工程团队集成 OpenAI Codex

Nextdoor 利用 OpenAI Codex 和 GPT-5.5 使单个工程师能够实现端到端产品所有权,将工程瓶颈从实现转移到战略规划。

169

Hugging Face Spaces agents.md 实现自动化 3D 多媒体流水线

一个编程智能体通过串联两个现有的 Space,自动构建了一个以 3D Gaussian splats 形式展示巴黎古迹的静态 Hugging Face Space,展示了 `agents.md` 如何将任何 Space 转化为多媒体流水线中可组合的构建模块。

170

OpenAI Codex 在 Notion 的集成

Notion 正在使用 OpenAI Codex 自动化功能开发,使工程师和经理能够在几小时而不是几周内交付生产就绪代码。

171

OpenAI 智能时代的工业政策

OpenAI 已提出一套以人为本的工业政策思想,以确保超智能的益处得到广泛共享,并启动了一项资助计划以支持相关研究。

172

将 GitHub CI 迁移到 Hugging Face Jobs

Hugging Face 提供了一种在无服务器 Hugging Face Jobs 基础设施上运行 GitHub Actions 的方法,实现 GPU 加速的 CI,并将 CPU 作业运行时间降低多达 30%。

173

vime RL 框架发布

vLLM 推出 vime,这是一个开源的 RL 后训练框架,它将 Megatron 训练与 vLLM 推理相结合,以提供一个稳定且高效的 LLM 强化学习管道。

174

OpenAI 保密 S-1 提交

OpenAI 已向 SEC 提交了一份保密的 S-1 草案,为公司提供了在保持私有状态以追求特定目标的同时选择上市的选项。

175

Google DeepMind 引导学习 AI 在塞拉利昂的试验

塞拉利昂的一项预登记试验表明,AI 驱动的引导学习可以在八周内将数学进步提升多达典型学习的 2.5 年,前提是它被用作教师主导的增强工具。

176

OpenAI 关于 AGI 分发与发展的战略计划

OpenAI 已宣布一项战略计划,以确保 AGI 惠及全人类,通过专注于自动化 AI 研究、经济加速以及向地球上的每个人提供个人 AGI。

177

OpenEnv: 标准化开源 AI 的 Agentic RL 环境

摘要: Hugging Face 已将 OpenEnv 过渡到一个社区协调项目,以充当 agentic 强化学习环境的互操作层。

178

OpenAI 经济研究交流启动

OpenAI 已启动经济研究交流,以向外部研究人员提供 OpenAI 工具和数据集的访问权限,以产生关于 AI 经济影响的独立实证证据。

179

vLLM Semantic Router v0.3 Themis 发布说明

vLLM Semantic Router v0.3 Themis 引入了有状态的生产级路由,其特点是会话感知智能体路由 (SAAR)、规范的配置契约,以及对 AMD ROCm 和 Intel OpenVINO 扩展的硬件支持。

180

NVIDIA Nemotron 3.5 内容安全发布

NVIDIA 发布了 Nemotron 3.5 Content Safety,这是一个拥有 4B 参数的多模态、多语言安全模型,具有自定义策略执行功能和可选的推理轨迹,适用于企业级 AI。

181

Endava AI 集成:使用 OpenAI Agents 重新设计软件交付

Endava 在其 11,000 人员工队伍中集成了 OpenAI 技术,以重新设计软件交付和运营工作流程,将 AI 从生产力工具转变为核心运营模型。

182

ChatGPT 做梦记忆更新

OpenAI 推出了一种基于 '做梦' 的更强大且计算效率更高的记忆架构,以改善 ChatGPT 如何合成、更新和回忆用户上下文、偏好和时敏感信息。

183

OpenAI 在智能时代的生物防御行动计划

OpenAI 已推出生物防御行动计划,通过为负责任的防御者配备先进的 AI 能力(具体利用 GPT-Rosalind 模型)来增强生物韧性。

184

Hugging Face hf CLI 针对智能体优化重构,降低了 Token 使用量并提升了成功率

Hugging Face 宣布对 hf CLI 进行了针对智能体优化的重构,将 Token 使用量降低了高达 6 倍,并提高了 Claude Code 和 Codex 等编程智能体的成功率。

185

NVIDIA Nemotron 3 Ultra 在 vLLM 上的支持

vLLM 宣布对 NVIDIA Nemotron 3 Ultra 提供 Day-0 支持,这是一个 550B 参数的模型,通过混合 Transformer-Mamba MoE 架构针对长时间运行的自主代理工作流程进行了优化。

186

GPT-Rosalind 更新:增强生命科学能力和研究工具

OpenAI 已更新 GPT-Rosalind,将 GPT-5.5 的 agentic 能力与药物化学、基因组学和湿实验故障排除的专业智能相结合,以服务于企业级生命科学研究。

187

TITLE: 直接偏好优化:超越聊天机器人

SUMMARY: 提供的源材料是来自 Hugging Face 的 429 限流错误页面,且不包含有关直接偏好优化的任何技术内容。

188

Wasmer 如何使用 Codex 构建边缘的 Node.js 运行时

Wasmer 利用 OpenAI 的 Codex 开发了 Edge.js,这是一种能够在 WebAssembly 沙箱中运行 Node.js 工作负载的 JavaScript 运行时,将开发时间从估计的一年缩短到两周。

189

OpenAI 前沿人工智能民主治理蓝图

OpenAI 发布了一份蓝图,提出一个三部分联邦框架,供美国通过国家标准化、加强 CAISI 和全政府韧性计划来治理日益强大的 AI 系统。

190

OpenAI Public Policy Agenda

On June 3, 2026, OpenAI released its public policy agenda outlining its mission, principles, and policy priorities across safety, youth protection, education, workforce transition, deepfakes, and AI infrastructure.

191

Hugging Face 速率限制阻止访问 'Adding MCP Tools to Reachy Mini' 文章

Hugging Face 指向博客文章 'Adding MCP Tools to Reachy Mini' 的链接返回 429 速率限制错误,因此无内容可供摘要。

192

vLLM 快速且高效的 LLM 推理课程上线

vLLM 与 DeepLearning.AI 及 Red Hat 合作推出了一门名为 Fast & Efficient LLM Inference with vLLM 的免费中级课程,旨在教授完整的 AI 部署生命周期。

193

Holo3.1: 快速 & 本地计算机使用代理

由于 429 速率限制错误,提供的 Holo3.1 源材料不可用,且未提供任何技术细节。

194

Travelers 部署由 OpenAI 驱动的 AI 理赔助手

Travelers 已经推出了一个由 OpenAI 的 Realtime API 驱动的全国范围的 AI 理赔助手,以自动化汽车财产损害索赔的首次损失通知,使得 85-90% 的用户能够自主完成理赔申报。

195

ChatGPT Sites: 通过 Codex 创建内部页面和轻量级应用

OpenAI 已推出 ChatGPT Sites,这是一项功能,允许用户直接从 Codex 桌面应用创建、部署和共享内部网站和轻量级交互式应用。

196

Codex 适用于每种角色、工具和工作流程

OpenAI 宣布为 Codex 推出新的角色特定插件、交互式站点和就地注释,将其使用范围扩展到开发者以外的分析师、市场人员、销售、投资者和银行家。

197

OpenAI 青少年 AI 安全提案与全球领导倡议

OpenAI 提出建立国际青少年安全研究所及九点适龄 AI 保护框架,以供 G7 领导人峰会讨论。

198

OpenAI Codex 向知识工作领域的扩张

OpenAI 报告称,Codex 的周活跃用户已达到 500 万,其中知识工作者目前占用户群的 20%,且增长速度比开发者快三倍。

199

vLLM 会话感知代理路由(SAAR)发布

vLLM 引入了会话感知代理路由(SAAR),这是一种模型选择策略,通过在工具循环和提供者状态转换期间防止不安全的模型切换,以保持会话连续性并降低长时程 LLM 代理的成本。

200

vLLM-Omni 通过 AutoRound 量化加速推理

vLLM-Omni 现在集成了 Intel 的 AutoRound 训练后量化技术,实现了 W4A16 量化,在保持准确性的同时将模型大小缩减高达 62%,并解锁了在 Intel XPU 和 NVIDIA GPU 上的性能增益。