5451

Hugging Face 开放 ASR 排行榜:使用私有数据集对抗 Benchmaxxing

Hugging Face 在开放 ASR 排行榜中引入了来自 Appen Inc. 和 DataoceanAI 的私有评估数据集,以防止测试集污染并提供更可靠的真实场景 ASR 性能衡量。

5452

Singular Bank 集成 ChatGPT 和 Codex 以推出 Singularity 助手

Singular Bank 开发了 Singularity,这是一个由 ChatGPT 和 Codex 驱动的内部 AI 助手,通过自动化投资组合分析和沟通,使银行家每天的生产力损失减少 60 到 90 分钟。

5453

Uber 与 OpenAI 集成:AI 驱动的司机指导与语音预订

Uber 正在整合 OpenAI 前沿模型,推出 Uber Assistant,以优化司机收入并通过语音预订降低乘客的使用摩擦。

5454

OpenAI 推出 ChatGPT Futures:2026 届

OpenAI 已推出 ChatGPT Futures 项目,为使用 AI 构建工具、推动研究并创造社会影响的 2026 届学生提供资助和模型访问权限。

5455

OpenAI B2B 信号:前沿公司如何领先

OpenAI 推出 B2B Signals,揭示前沿公司(使用率位于第95百分位)现在每位员工使用的智能量是普通公司的 3.5 倍,驱动因素是复杂的代理式工作流。

5456

GPT-5.5 Instant 发布说明 / 新功能

OpenAI 已发布 GPT-5.5 Instant,作为 ChatGPT 的新默认模型,提升了事实准确性,降低了冗长程度,并通过更深入的用户上下文集成增强了个性化。

5457

OpenAI MRC 多路径可靠连接协议

OpenAI 通过开放计算项目(Open Compute Project)发布了多路径可靠连接(MRC)协议,以提升大规模 AI 训练集群中 GPU 网络的弹性和性能。

5458

GPT-5.5 Instant 系统卡

OpenAI 已发布 GPT-5.5 Instant 系统卡,标志着首次将 Instant 模型在网络安全和生物与化学防护类别中归类为高能力。

5459

OpenAI 欧洲青年安全蓝图与 EMEA 青年福祉资助

OpenAI 宣布了其欧洲青年安全蓝图以及首批 EMEA 青年福祉资助的受助者,以促进适龄 AI 使用并保护欧洲、中东和非洲的年轻人。

5460

OpenAI 扩大 ChatGPT 广告试点,推出自助广告管理平台和 CPC 竞价

OpenAI 正在通过推出 beta 自助广告管理平台、按点击付费 (CPC) 竞价以及扩展的测量工具,来扩大其 ChatGPT 广告试点,使各类规模的企业更容易投放广告。

5461

OpenAI 和 PwC 合作开展金融领域的 AI 代理

OpenAI 和 PwC 正在合作部署 AI 代理以自动化金融工作流程,利用 OpenAI 自身的金融组织作为测试环境,以现代化 CFO 办公室。

5462

OpenAI 低延迟语音 AI 基础设施

OpenAI 通过采用分离的中继加收发器架构,重新设计了其 WebRTC 堆栈,以向超过 9 亿每周活跃用户提供低延迟、可扩展的语音 AI。

5463

Google DeepMind AI 协同临床医生研究计划

Google DeepMind 推出了 AI 协同临床医生研究计划,这是一套多模态 AI 系统,旨在在临床监督下通过证据综合和实时患者交互来支持医疗提供者。

5464

Qwen-Scope 可解释性工具包发布

Qwen 发布了 Qwen-Scope,这是一款使用稀疏自编码器(SAE)将 Qwen3 与 Qwen3.5 系列模型的隐藏表征分解为可解释特征,以便进行模型优化的可解释性工具包。

5465

OpenAI 高级账户安全发布

OpenAI 已推出高级账户安全,这是一个针对 ChatGPT 和 Codex 账户的可选设置,强制使用防钓鱼身份验证并禁用传统恢复方式,以保护高风险用户。

5466

OpenAI 对模型行为的分析:‘妖精’词汇抽搐

OpenAI 发现,针对‘书呆子’人格功能的奖励信号导致 GPT-5.1 至 GPT-5.5 的模型形成了使用妖精和小恶魔隐喻的无意习惯,并且这种习惯进一步在其他模型行为中泛化。

5467

IBM Granite 4.1 LLMs 发行说明 / 技术概览

IBM 发布了 Granite 4.1,这是一系列密集型、仅解码器的 LLMs(3B、8B、30B),通过严格的数据策划和多阶段强化学习管道实现高性能。

5468

OpenAI Stargate 计算基础设施更新

OpenAI 已超额完成其在美国的 10GW AI 基础设施初始目标,并在其位于德克萨斯州阿比林的旗舰 Stargate 站点训练了 GPT-5.5。

5469

OpenAI 智能时代网络安全行动计划

OpenAI 已推出一个五支柱行动计划,以民主化 AI 驱动的网络防御并增强对 AI 驱动威胁的韧性。

5470

DeepInfra 与 Hugging Face 推理提供商集成

Hugging Face 已将 DeepInfra 添加为支持的推理提供商,使得可以直接通过 Hub 和客户端 SDK 访问超过 100 种模型的无服务器访问,包括 DeepSeek V4 和 Kimi-K2.6。

5471

NVIDIA Nemotron 3 Nano Omni 发布说明 / 新特性

NVIDIA 发布了 Nemotron 3 Nano Omni,这是一款全模态模型,能够跨文本、图像、视频和音频进行长上下文推理,并在文档智能和视频理解基准测试中提供了业界领先的准确率。

5472

FlashQLA:面向 CP / 反向友好的融合线性注意力内核(用于 GDN)

Qwen 开源了 FlashQLA,这是一款基于 TileLang 的高性能线性注意力内核库,在 NVIDIA Hopper GPU 上实现了对门控增量网络(GDN)层的 2-3 倍前向加速和 2 倍反向加速。

5473

OpenAI 社区安全与暴力缓解框架

OpenAI 已详细阐述其多层次方法,以防止 ChatGPT 被用于策划或执行暴力,结合了模型训练、自动检测和人工审查。

5474

NVIDIA Nemotron 3 Nano Omni 在 vLLM 中的支持

vLLM 现在支持 NVIDIA Nemotron 3 Nano Omni,这是一款高效的 30B MoE 多模态模型,将视觉、音频和语言推理统一到单一循环中,为代理式 AI 提供动力。

5475

OpenAI GPT-5.5、Codex 与 AWS 上的托管代理发布说明

2026年4月28日,OpenAI 宣布其前沿模型(包括 GPT-5.5、Codex 编码代理以及由 OpenAI 提供动力的 Amazon Bedrock 托管代理)现已在 AWS 上以有限预览方式提供,使企业能够在其现有的 AWS 安全、合规和采购工作流中使用这些功能。

5476

OpenAI 获得 FedRAMP 中等授权

OpenAI 已获得针对 ChatGPT Enterprise 和其 API 平台的 FedRAMP 20x 中等授权,使美国政府机构能够在符合联邦安全和隐私标准的前提下访问包括 GPT-5.5 在内的前沿 AI 模型。

5477

Google DeepMind 与大韩民国的合作伙伴关系

Google DeepMind 已与韩国科学技术信息通信部达成合作,在首尔建立一个 AI Campus,并部署前沿 AI 模型,以加速生命科学、能源和气候领域的科学研究。

5478

微软与OpenAI合作的下一阶段

OpenAI 与微软已修改合作协议,以提供更大的灵活性,允许 OpenAI 在任何云提供商上提供产品,同时仍将微软作为其主要云合作伙伴。

5479

Choco 使用 AI 代理自动化食品分发

Choco 宣布了基于 OpenAI API 构建的 AI 驱动的 OrderAgent 和 VoiceAgent,以实现食品分发订单处理的自动化。

5480

Symphony: Codex 编排的开源规范

OpenAI 发布了 Symphony,这是一个开源规范,可将 Linear 等问题追踪器转变为 Codex 编程代理的常驻编排器,使团队能够自动化常规实现工作并提高 PR 吞吐量。

5481

# OpenAI 隐私过滤器:构建可扩展的 PII 检测 Web 应用

OpenAI 已发布 Privacy Filter,这是一个开源的 15亿参数 PII 检测器,能够在 128k 上下文窗口中标记八类敏感数据。

5482

OpenAI 通用人工智能(AGI)开发的运营原则

OpenAI 已概述五个核心原则——民主化、赋能、韧性、普遍繁荣和适应性——以确保通用人工智能(AGI)造福全人类。

5483

OpenAI AI 工作转型框架

OpenAI 推出了 AI 工作转型框架,以分析 AI 对 921 种职业就业的影响,根据自动化风险、重组、增长潜力和稳定性将工作划分为四条路径。

5484

DeepSeek-V4 发布说明:为 AI Agent 提供高效的 1M-Token 上下文

DeepSeek-V4 引入了由混合 CSA/HCA 注意力机制驱动的 1M-token 上下文窗口,专门针对长程 Agent 工作负载和工具使用轨迹进行了优化。

5485

vLLM DeepSeek V4 支持:高效长上下文注意力

vLLM 现已支持 DeepSeek V4-Pro 和 V4-Flash,实现了一种新注意力机制,使上下文长度可达一百万 token,并显著节省 KV 缓存内存。

5486

OpenAI GPT-5.5 系统卡

OpenAI 已发布 GPT-5.5,这是一个针对复杂真实世界任务和工具使用进行优化的模型,具有增强的任务理解能力和更强大的安全框架。

5487

OpenAI GPT-5.5 发布说明

OpenAI 已发布 GPT-5.5 和 GPT-5.5 Pro,在保持 GPT-5.4 延迟不变的同时,显著提升了代理式编码、计算机使用和科学研究能力。

5488

如何使用 ChatGPT Work 处理日常任务

OpenAI 于 2026 年 4 月 23 日的 Academy 文章解释了 ChatGPT Work 如何将现有工作材料(如日历、电子邮件、文档和电子表格)转化为团队可以审查和编辑的初稿简报、摘要、幻灯片、工作簿、计划和流程文档。

5489

使用 Transformers.js 在 Chrome 扩展程序中

Hugging Face 提供了一份关于在清单 V3 下将 Transformers.js 集成到 Chrome 扩展程序的技术指南,展示了由 Gemma 4 E2B 驱动的后台托管模型架构。

5490

ChatGPT for Clinicians 发布

OpenAI 推出了 ChatGPT for Clinicians,这是一款面向经验证的美国医疗提供者的免费版 ChatGPT,旨在自动化文档编写、医学研究和临床工作流程。

5491

Google DeepMind 去耦合 DiLoCo

Google DeepMind 推出了去耦合 DiLoCo,这是一种分布式训练架构,能够在远程数据中心使用低带宽和混合不同代的硬件实现具有韧性的异步 LLM 训练。

5492

在 ChatGPT 中引入工作区代理 – OpenAI 研究预览

OpenAI 在 ChatGPT 中推出了工作区代理,使团队能够创建共享的、云端运行的 AI 代理,在遵守组织控制的前提下,跨工具自动化多步骤工作流。

5493

ChatGPT 中的工作区代理:概述与构建方法

OpenAI 在 ChatGPT 中推出了工作区代理,通过结合触发器、流程和工具集成,实现可重复的结构化工作流自动化,使团队能够共享一致的 AI 驱动任务。

5494

OpenAI Responses API WebSocket 模式发布

OpenAI 为 Responses API 引入了 WebSocket 支持,通过消除冗余的 API 开销,使推理速度提升至每秒 4,000 令牌,并将代理工作流的延迟降低了最高 40%。

5495

Qwen3.6-27B 发布说明 / 新功能

Qwen 发布了 Qwen3.6-27B,这是一款密集的 270 亿参数多模态模型,在所有主要的代理式编码基准上均优于更大的 Qwen3.5-397B-A17B。

5496

vLLM FP8 KV-Cache 和 Attention 量化更新

vLLM 已优化 FP8 KV-cache 和 attention 量化,在 Hopper 和 Blackwell 架构上降低了解码延迟和内存占用,同时保持了接近基准的准确性。

5497

OpenAI 隐私过滤器发布

OpenAI 已发布 Privacy Filter,这是一款开源权重、拥有 15 亿参数的模型,旨在高吞吐、上下文感知地检测并编辑非结构化文本中的个人可识别信息(PII)。

5498

Google DeepMind 与 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey 合作,加速 AI 转型

Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey 建立合作伙伴关系,通过提供对 Gemini 等前沿模型的早期访问、共同开发行业特定的 AI 解决方案,以及将领导层与客户 CEO 对接,以加速企业 AI 转型。

5499

ChatGPT Images 2.0 发布

OpenAI 发布了 ChatGPT Images 2.0,这是对其图像生成能力的重大更新,具备更高的精度、多语言文本渲染以及增强的风格写实性。

5500

QIMMA:质量优先的阿拉伯语大型语言模型排行榜

Hugging Face 及其合作伙伴推出了 QIMMA,这是一款全新的阿拉伯语 LLM 排行榜,采用严格的质量验证流水线,以确保基准测试真实反映语言能力。