201

OpenAI 政策和政治倡导立场

OpenAI 已澄清,它不为政治行动委员会或候选人提供资金,并坚持认为 AI 政策应由广泛的利益相关者联盟塑造,而非单一组织。

202

JetBrains Mellum2 发布

JetBrains 宣布发布了 Mellum2,这是一款 12B Mixture-of-Experts(MoE)模型,但提供的源材料是错误页面,未包含任何技术细节。

203

超越LLMs:为什么可扩展的企业AI采用依赖于Agent Logic

由于提供的源材料遇到了 429 Too Many Requests 错误而不可用,因此不包含有关 Agent Logic 或企业 AI 采用的任何技术内容。

204

OpenAI Stargate:密歇根的 Barn 数据中心

OpenAI 已在密歇根州萨林启动了 The Barn 项目——一个 1GW 数据中心园区,作为其 Stargate 计划的一部分,以扩展 AI 基础设施并支持美国再工业化。

205

OpenAI 前沿模型和 Codex 现已在 AWS 上提供

OpenAI 已将其前沿模型和 Codex 集成到 AWS,使企业能够使用现有的 AWS 安全、合规和计费工作流部署 OpenAI 能力。

206

Qwen3.7-Plus 发布说明 / 新功能

Qwen3.7-Plus 是一种多模态代理模型,将视觉和语言统一,使其能够在 GUI 和 CLI 环境中运行,以实现复杂的软件工程和生产力自动化。

207

vLLM 在 DGX Spark 上:架构、配置与本地评估

vLLM 为 NVIDIA DGX Spark 提供高性能的本地推理端点,利用统一内存架构和兼容 OpenAI 的 API,实现了包括 Nemotron-3-Super 在内的大型 NVFP4 模型的部署。

208

OpenAI 打断‘数据中心潮流’影响行动

OpenAI 禁止了一批与中国关联的账户,这些账户使用 `ChatGPT` 生成社交媒体内容和运营计划,旨在影响美国受众关于 AI 电力需求的看法,并骚扰中国异议人士。

209

OpenAI 打击与中国关联的“技术与关税”影响行动

OpenAI 禁止了一批由中国关联行为者使用的 ChatGPT 账户,这些账户用于生成亲中叙事、批评美国科技政策,并试图通过虚假数据泄露声明抹黑 OpenAI。

210

Braintrust 对 OpenAI Codex 的集成

Braintrust 使用 OpenAI Codex 将客户功能请求在几分钟内转化为可运行的代码预览,显著加快了其开发反馈循环。

211

波士顿儿童医院 AI 集成与罕见疾病诊断

波士顿儿童医院已集成企业 AI 层,以优化运营并诊断超过 40 种先前未解决的罕见疾病。

212

Qwen-VLA:统一具身智能的视觉-语言-动作建模

Qwen-VLA 是一种通用的视觉-语言-动作模型,将机器人操作、视觉-语言导航以及跨具身控制统一为单一的通用策略模型。

213

OpenAI Rosalind 生物防御与 GPT-Rosalind 扩展

OpenAI 已启动 Rosalind 生物防御计划,并扩大了对 GPT-Rosalind 的受信任访问,以供政府和盟国合作伙伴使用,以加速生物防御和大流行防护工具的开发。

214

OpenAI 分享了用于可信第三方前沿 AI 模型评估的指南手册

OpenAI 发布了一份共享的指南手册,解释了第三方评估者应如何选择 harness、引出能力以及检查有效性,以产生对前沿 AI 模型的可信评估。

215

PyTorch 性能分析:torch.profiler 初学者指南

Hugging Face 提供了使用 torch.profiler 识别瓶颈、了解 CPU-GPU 调度链以及分析 torch.compile 对内核执行影响的完整指南。

216

Endava 的 OpenAI Codex 代理组织策略

Endava 通过使用 OpenAI Codex 编码高级架构专业知识并将软件交付生命周期从几周压缩到几天,已转变为代理组织。

217

Laguna XS.2 使用 vLLM、Speculators 和 LLM Compressor 进行推理优化

Poolside 和 Red Hat AI 使用 vLLM 集成、DFlash 推测解码和 LLM Compressor 量化,对 Laguna XS.2 33B-A3B MoE 模型进行了优化,以适用于 agentic 编码任务。

218

vLLM 语义路由器多模态路由和视觉编码器加固

vLLM 为语义路由器(VSR)引入了多模态路由,使得系统能够将视觉证据作为请求级策略决策的一等信号使用,同时解决了 Rust/Candle 与 PyTorch 路径之间的关键实现漂移。

219

Speculators v0.5.0 发行说明 / 新功能

Speculators v0.5.0 引入了 DFlash 算法支持,用于单次通过草稿令牌生成,通过 vLLM 原生隐藏状态提取统一了在线和离线训练,并提供了更新的文档。

220

vLLM 原生 RL API 发布

vLLM 已引入原生权重同步 API 并改进了异步 RL 支持,以标准化训练和推理之间的权重传输,并在大规模 DPEP 部署中消除死锁。

221

OpenAI 前沿治理框架

OpenAI 推出了前沿治理框架,以使其安全和安保实践符合新兴的法律要求,如欧盟《人工智能法案》和加州《前沿人工智能透明度法案》。

222

Cisco 和 OpenAI Codex 企业集成

Cisco 将 OpenAI 的 Codex 集成到其生产工程工作流程中,将特性开发时间从几个季度缩短到几周,并实现了缺陷解决吞吐量提高 10-15 倍。

223

使用 Codex 构建自我改进的税务代理

OpenAI 和 Thrive Holdings 开发了 Tax AI,这是一个为 Crete 会计师设计的自我改进代理,利用 Codex 驱动的循环来自动化复杂的税务申报,准确率最高可达 97%。

224

Reachy Mini 本地语音后端集成

Hugging Face 为 Reachy Mini 发布了一个本地语音到语音管道,使机器人能够使用级联的 VAD、STT、LLM 和 TTS 堆栈完全在本地处理对话。

225

OpenAI 2026 年选举信息与防护措施

OpenAI 已宣布一套全面的防护措施,适用于 2026 年选举周期,重点在于可靠信息呈现、网络基础设施防御、内容溯源以及防止模型偏见。

226

Warp 开放式 Agentic 开发与 Oz 编排平台

Warp 正在使用 GPT-5.5 和其 Oz 编排平台实施开放式 Agentic 开发,以将软件工程转向人类监督的代理群。

227

TRL 中的 Delta Weight Sync 实现极低带宽下的万亿参数模型训练

Hugging Face 宣布在 TRL 中推出 Delta Weight Sync 功能。通过仅通过 Hugging Face Buckets 传输稀疏权重变化,该功能将异步 RL 训练中的权重同步带宽降低了 100 倍以上,从而实现了无需共享集群的解耦训练。

228

EAGLE 3.1 发布说明:提升推测解码的鲁棒性和效率

EAGLE 3.1 引入架构改进以解决注意力漂移,在长上下文工作负载中将接受长度翻倍,并通过 vLLM 和 TorchSpec 的集成显著提升吞吐量。

229

Hugging Face AI Agent Glossary: Defining Harness, Scaffold, and Agent Architecture

Hugging Face 为 AI 代理提供了一套标准化的词汇表,将代理定义为模型、用于执行的 harness 以及用于行为定义的 scaffolding 的组合。

230

标题: OpenAI、Grupo Folha 和 Grupo UOL 战略内容合作伙伴关系

摘要: OpenAI 已与巴西的 Grupo Folha 和 Grupo UOL 合作,将高质量的巴西新闻业务整合到 ChatGPT 中,为全球 9 亿周活跃用户提供有依据且带有署名的报道。

231

OpenAI 分析:AI 作为小企业的首位雇佣

OpenAI 报告称,四百万美国用户在 2026 年 3 月使用 ChatGPT 支持小企业运营,减轻了行政负担并降低了创业的固定成本。

232

维珍航空使用 OpenAI Codex 的软件开发

维珍航空利用 OpenAI Codex 推出全新移动应用,实现零 P1 缺陷,并将遗留代码库规模降低至最高 80%。

233

OpenAI Codex 被评为 2026 年 Gartner 魔力象限企业 AI 编码代理的领袖

OpenAI 被认定为 Gartner 魔力象限企业 AI 编码代理的领袖,体现了 Codex 的规模和治理能力。

234

Google DeepMind 加速器计划(亚太地区)

Google DeepMind 在亚太地区推出了“AI 为地球”加速器计划,帮助初创企业、研究团队和非营利组织扩大前沿 AI 解决方案,以应对环境风险。

235

AdventHealth 与 OpenAI:通过规模化应用 AI 来减轻临床行政负担

AdventHealth 正在部署 ChatGPT for Healthcare 以实现耗时文档记录和临床工作流程的自动化,从而找回临床医生的时间,以扩大患者护理能力。

236

Qwen3.7-Max 代理模型发布

Qwen 发布了 Qwen3.7-Max,这是一款面向代理的全新基础模型,擅长编码、办公自动化以及超长时程的自主任务,现已通过阿里云模型工作室提供。

237

Codex with GPT-5.5 Speeds Up Code Review at Ramp

Ramp 工程师使用 Codex with GPT-5.5 在几分钟内获得实质性的 pull‑request 反馈,而不是花费数小时,并构建了诸如 On‑Call Assistant 之类的内部 agentic tools。

238

OpenAI 教育面向国家计划项目更新

OpenAI 正在扩展其教育面向国家计划,以纳入新加坡,并在其首批合作伙伴国家中扩大研究驱动的 AI 部署,以通过代理 AI 改善学习成果。

239

OpenAI模型推翻平面单位距离猜想

OpenAI通用推理模型通过发现相对于方格构造的多项式改进,独立推翻了离散几何中一个已有80年历史的猜想。

240

OpenAI 新加坡合作伙伴关系公告

OpenAI 已推出“OpenAI for Singapore”,这是一项与数字发展与信息部合作的 S$3 亿计划,旨在建立应用人工智能实验室并培养本地人工智能人才。

241

OlmoEarth v1.1 发行说明 / 新功能

Hugging Face 和 AllenAI 发布了 OlmoEarth v1.1,这是一个地球观测模型系列,可将计算成本降低最高可达 3 倍,同时保持与 v1 相似的性能。

242

OpenAI 内容来源更新

OpenAI 正在使用 C2PA 符合性、Google SynthID 水印和一个新的公开验证工具实施多层来源系统,以提高 AI 生成内容信号的透明度和持久性。

243

Qwen3.5-LiveTranslate-Flash 发布说明

Qwen3.5-LiveTranslate-Flash 是基于 Qwen3.5-Omni 的同声传译模型,提供实时、多模态翻译,支持 60 种语言,具备超低延迟和语音克隆功能。

244

Ettin 重排序器系列 v1 发布说明

Hugging Face 发布了 Ettin 重排序器系列,六个参数规模从 17M 到 1B 的 CrossEncoder 重排序器,均通过 mxbai-rerank-large-v2 蒸馏而成,达到了检索重排序的最新水平的质量和速度。

245

Google DeepMind:快速推进基因线索以逆转细胞衰老

Google DeepMind 的 Co-Scientist AI 正在通过识别新颖的基因因素并将数据分析时间从六个月缩短至几天,加速细胞衰老研究。

246

PaddleOCR 3.5 发布说明 / 新功能

PaddleOCR 3.5 引入 Hugging Face Transformers 作为支持的推理后端,使 OCR 和文档解析模型能够更顺畅地集成到基于 PyTorch 的工作流中。

247

OpenAI 与 Dell Technologies 合作推动企业级 Codex 部署

OpenAI 与 Dell Technologies 已达成合作伙伴关系,通过 Dell AI Data Platform 和 Dell AI Factory,实现在混合和本地企业环境中部署 Codex。

248

vLLM x Novita AI: 用于生产级外部 KV Cache 的 PegaFlow

vLLM 与 Novita AI 宣布推出 PegaFlow,这是一种外部 KV cache 服务,它将 KV cache 与 vLLM worker 解耦,从而实现更快的启动速度、通过缓存共享实现更高的吞吐量以及基于 RDMA 的跨节点访问。

249

Project Genie 街景集成

Google DeepMind 已将 Google 街景图像集成到 Project Genie 中,使通用世界模型能够为 AI 代理和用户生成交互式、落地的真实环境。

250

Gemini Omni Flash 发布

Google DeepMind 已推出 Gemini Omni Flash,这是一个原生多模态模型,能够从文本、图像、音频和视频输入的组合中生成和编辑高质量视频。