Uber 与 OpenAI 集成:AI 驱动的司机指导与语音预订
Uber 正在整合 OpenAI 前沿模型,推出 Uber Assistant,以优化司机收入并通过语音预订降低乘客的使用摩擦。
OpenAI 推出 ChatGPT Futures:2026 届
OpenAI 已推出 ChatGPT Futures 项目,为使用 AI 构建工具、推动研究并创造社会影响的 2026 届学生提供资助和模型访问权限。
OpenAI B2B 信号:前沿公司如何领先
OpenAI 推出 B2B Signals,揭示前沿公司(使用率位于第95百分位)现在每位员工使用的智能量是普通公司的 3.5 倍,驱动因素是复杂的代理式工作流。
GPT-5.5 Instant 发布说明 / 新功能
OpenAI 已发布 GPT-5.5 Instant,作为 ChatGPT 的新默认模型,提升了事实准确性,降低了冗长程度,并通过更深入的用户上下文集成增强了个性化。
OpenAI MRC 多路径可靠连接协议
OpenAI 通过开放计算项目(Open Compute Project)发布了多路径可靠连接(MRC)协议,以提升大规模 AI 训练集群中 GPU 网络的弹性和性能。
GPT-5.5 Instant 系统卡
OpenAI 已发布 GPT-5.5 Instant 系统卡,标志着首次将 Instant 模型在网络安全和生物与化学防护类别中归类为高能力。
OpenAI 欧洲青年安全蓝图与 EMEA 青年福祉资助
OpenAI 宣布了其欧洲青年安全蓝图以及首批 EMEA 青年福祉资助的受助者,以促进适龄 AI 使用并保护欧洲、中东和非洲的年轻人。
OpenAI 扩大 ChatGPT 广告试点,推出自助广告管理平台和 CPC 竞价
OpenAI 正在通过推出 beta 自助广告管理平台、按点击付费 (CPC) 竞价以及扩展的测量工具,来扩大其 ChatGPT 广告试点,使各类规模的企业更容易投放广告。
OpenAI 和 PwC 合作开展金融领域的 AI 代理
OpenAI 和 PwC 正在合作部署 AI 代理以自动化金融工作流程,利用 OpenAI 自身的金融组织作为测试环境,以现代化 CFO 办公室。
OpenAI 低延迟语音 AI 基础设施
OpenAI 通过采用分离的中继加收发器架构,重新设计了其 WebRTC 堆栈,以向超过 9 亿每周活跃用户提供低延迟、可扩展的语音 AI。
Google DeepMind AI 协同临床医生研究计划
Google DeepMind 推出了 AI 协同临床医生研究计划,这是一套多模态 AI 系统,旨在在临床监督下通过证据综合和实时患者交互来支持医疗提供者。
Qwen-Scope 可解释性工具包发布
Qwen 发布了 Qwen-Scope,这是一款使用稀疏自编码器(SAE)将 Qwen3 与 Qwen3.5 系列模型的隐藏表征分解为可解释特征,以便进行模型优化的可解释性工具包。
OpenAI 高级账户安全发布
OpenAI 已推出高级账户安全,这是一个针对 ChatGPT 和 Codex 账户的可选设置,强制使用防钓鱼身份验证并禁用传统恢复方式,以保护高风险用户。
OpenAI 对模型行为的分析:‘妖精’词汇抽搐
OpenAI 发现,针对‘书呆子’人格功能的奖励信号导致 GPT-5.1 至 GPT-5.5 的模型形成了使用妖精和小恶魔隐喻的无意习惯,并且这种习惯进一步在其他模型行为中泛化。
IBM Granite 4.1 LLMs 发行说明 / 技术概览
IBM 发布了 Granite 4.1,这是一系列密集型、仅解码器的 LLMs(3B、8B、30B),通过严格的数据策划和多阶段强化学习管道实现高性能。
OpenAI Stargate 计算基础设施更新
OpenAI 已超额完成其在美国的 10GW AI 基础设施初始目标,并在其位于德克萨斯州阿比林的旗舰 Stargate 站点训练了 GPT-5.5。
OpenAI 智能时代网络安全行动计划
OpenAI 已推出一个五支柱行动计划,以民主化 AI 驱动的网络防御并增强对 AI 驱动威胁的韧性。
DeepInfra 与 Hugging Face 推理提供商集成
Hugging Face 已将 DeepInfra 添加为支持的推理提供商,使得可以直接通过 Hub 和客户端 SDK 访问超过 100 种模型的无服务器访问,包括 DeepSeek V4 和 Kimi-K2.6。
NVIDIA Nemotron 3 Nano Omni 发布说明 / 新特性
NVIDIA 发布了 Nemotron 3 Nano Omni,这是一款全模态模型,能够跨文本、图像、视频和音频进行长上下文推理,并在文档智能和视频理解基准测试中提供了业界领先的准确率。
FlashQLA:面向 CP / 反向友好的融合线性注意力内核(用于 GDN)
Qwen 开源了 FlashQLA,这是一款基于 TileLang 的高性能线性注意力内核库,在 NVIDIA Hopper GPU 上实现了对门控增量网络(GDN)层的 2-3 倍前向加速和 2 倍反向加速。
OpenAI 社区安全与暴力缓解框架
OpenAI 已详细阐述其多层次方法,以防止 ChatGPT 被用于策划或执行暴力,结合了模型训练、自动检测和人工审查。
NVIDIA Nemotron 3 Nano Omni 在 vLLM 中的支持
vLLM 现在支持 NVIDIA Nemotron 3 Nano Omni,这是一款高效的 30B MoE 多模态模型,将视觉、音频和语言推理统一到单一循环中,为代理式 AI 提供动力。
OpenAI GPT-5.5、Codex 与 AWS 上的托管代理发布说明
2026年4月28日,OpenAI 宣布其前沿模型(包括 GPT-5.5、Codex 编码代理以及由 OpenAI 提供动力的 Amazon Bedrock 托管代理)现已在 AWS 上以有限预览方式提供,使企业能够在其现有的 AWS 安全、合规和采购工作流中使用这些功能。
OpenAI 获得 FedRAMP 中等授权
OpenAI 已获得针对 ChatGPT Enterprise 和其 API 平台的 FedRAMP 20x 中等授权,使美国政府机构能够在符合联邦安全和隐私标准的前提下访问包括 GPT-5.5 在内的前沿 AI 模型。
Google DeepMind 与大韩民国的合作伙伴关系
Google DeepMind 已与韩国科学技术信息通信部达成合作,在首尔建立一个 AI Campus,并部署前沿 AI 模型,以加速生命科学、能源和气候领域的科学研究。
微软与OpenAI合作的下一阶段
OpenAI 与微软已修改合作协议,以提供更大的灵活性,允许 OpenAI 在任何云提供商上提供产品,同时仍将微软作为其主要云合作伙伴。
Choco 使用 AI 代理自动化食品分发
Choco 宣布了基于 OpenAI API 构建的 AI 驱动的 OrderAgent 和 VoiceAgent,以实现食品分发订单处理的自动化。
Symphony: Codex 编排的开源规范
OpenAI 发布了 Symphony,这是一个开源规范,可将 Linear 等问题追踪器转变为 Codex 编程代理的常驻编排器,使团队能够自动化常规实现工作并提高 PR 吞吐量。
# OpenAI 隐私过滤器:构建可扩展的 PII 检测 Web 应用
OpenAI 已发布 Privacy Filter,这是一个开源的 15亿参数 PII 检测器,能够在 128k 上下文窗口中标记八类敏感数据。
OpenAI 通用人工智能(AGI)开发的运营原则
OpenAI 已概述五个核心原则——民主化、赋能、韧性、普遍繁荣和适应性——以确保通用人工智能(AGI)造福全人类。
OpenAI AI 工作转型框架
OpenAI 推出了 AI 工作转型框架,以分析 AI 对 921 种职业就业的影响,根据自动化风险、重组、增长潜力和稳定性将工作划分为四条路径。
DeepSeek-V4 发布说明:为 AI Agent 提供高效的 1M-Token 上下文
DeepSeek-V4 引入了由混合 CSA/HCA 注意力机制驱动的 1M-token 上下文窗口,专门针对长程 Agent 工作负载和工具使用轨迹进行了优化。
vLLM DeepSeek V4 支持:高效长上下文注意力
vLLM 现已支持 DeepSeek V4-Pro 和 V4-Flash,实现了一种新注意力机制,使上下文长度可达一百万 token,并显著节省 KV 缓存内存。
OpenAI GPT-5.5 系统卡
OpenAI 已发布 GPT-5.5,这是一个针对复杂真实世界任务和工具使用进行优化的模型,具有增强的任务理解能力和更强大的安全框架。
OpenAI GPT-5.5 发布说明
OpenAI 已发布 GPT-5.5 和 GPT-5.5 Pro,在保持 GPT-5.4 延迟不变的同时,显著提升了代理式编码、计算机使用和科学研究能力。
如何使用 ChatGPT Work 处理日常任务
OpenAI 于 2026 年 4 月 23 日的 Academy 文章解释了 ChatGPT Work 如何将现有工作材料(如日历、电子邮件、文档和电子表格)转化为团队可以审查和编辑的初稿简报、摘要、幻灯片、工作簿、计划和流程文档。
使用 Transformers.js 在 Chrome 扩展程序中
Hugging Face 提供了一份关于在清单 V3 下将 Transformers.js 集成到 Chrome 扩展程序的技术指南,展示了由 Gemma 4 E2B 驱动的后台托管模型架构。
ChatGPT for Clinicians 发布
OpenAI 推出了 ChatGPT for Clinicians,这是一款面向经验证的美国医疗提供者的免费版 ChatGPT,旨在自动化文档编写、医学研究和临床工作流程。
Google DeepMind 去耦合 DiLoCo
Google DeepMind 推出了去耦合 DiLoCo,这是一种分布式训练架构,能够在远程数据中心使用低带宽和混合不同代的硬件实现具有韧性的异步 LLM 训练。
在 ChatGPT 中引入工作区代理 – OpenAI 研究预览
OpenAI 在 ChatGPT 中推出了工作区代理,使团队能够创建共享的、云端运行的 AI 代理,在遵守组织控制的前提下,跨工具自动化多步骤工作流。
ChatGPT 中的工作区代理:概述与构建方法
OpenAI 在 ChatGPT 中推出了工作区代理,通过结合触发器、流程和工具集成,实现可重复的结构化工作流自动化,使团队能够共享一致的 AI 驱动任务。
OpenAI Responses API WebSocket 模式发布
OpenAI 为 Responses API 引入了 WebSocket 支持,通过消除冗余的 API 开销,使推理速度提升至每秒 4,000 令牌,并将代理工作流的延迟降低了最高 40%。
Qwen3.6-27B 发布说明 / 新功能
Qwen 发布了 Qwen3.6-27B,这是一款密集的 270 亿参数多模态模型,在所有主要的代理式编码基准上均优于更大的 Qwen3.5-397B-A17B。
vLLM FP8 KV-Cache 和 Attention 量化更新
vLLM 已优化 FP8 KV-cache 和 attention 量化,在 Hopper 和 Blackwell 架构上降低了解码延迟和内存占用,同时保持了接近基准的准确性。
OpenAI 隐私过滤器发布
OpenAI 已发布 Privacy Filter,这是一款开源权重、拥有 15 亿参数的模型,旨在高吞吐、上下文感知地检测并编辑非结构化文本中的个人可识别信息(PII)。
Google DeepMind 与 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey 合作,加速 AI 转型
Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte 和 McKinsey 建立合作伙伴关系,通过提供对 Gemini 等前沿模型的早期访问、共同开发行业特定的 AI 解决方案,以及将领导层与客户 CEO 对接,以加速企业 AI 转型。
ChatGPT Images 2.0 发布
OpenAI 发布了 ChatGPT Images 2.0,这是对其图像生成能力的重大更新,具备更高的精度、多语言文本渲染以及增强的风格写实性。
QIMMA:质量优先的阿拉伯语大型语言模型排行榜
Hugging Face 及其合作伙伴推出了 QIMMA,这是一款全新的阿拉伯语 LLM 排行榜,采用严格的质量验证流水线,以确保基准测试真实反映语言能力。
# 将 Codex 扩展到全球企业 – OpenAI 公告
OpenAI 宣布,Codex 使用量从每周超过 300 万开发者增长到超过 400 万开发者,并推出了 Codex Labs 以及全球系统集成商合作伙伴计划,以帮助企业在软件开发生命周期及更广泛的范围内采用 Codex。
vLLM v0.20.0 为混合 SSM 模型添加了分离式服务
vLLM v0.20.0 引入了针对混合 SSM‑FA 模型的分离式预填充/解码服务,通过双描述符视图和三描述符卷积状态传输实现高效的 KV 传输。