OpenAI GPT-5.4 mini 和 nano 发布说明

OpenAI 已发布 GPT-5.4 mini 和 nano,这两款小规模模型旨在为高并发工作负载提供 GPT-5.4 系列的推理和多模态能力。这些模型以速度和成本效率为优先,适用于对低延迟至关重要的用户体验的应用场景。

GPT-5.4 mini:高性能效率

GPT-5.4 mini 旨在满足需要速度与智能平衡的专业任务。它的运行速度比 GPT-5 mini 快超过 2 倍,并在包括 OSWorld-Verified 和 SWE-Bench Pro 在内的多项关键评估中接近完整 GPT-5.4 模型的表现。

性能基准

GPT-5.4 mini(超高推理力度)相较于其前身 GPT-5 mini(高推理力度)展现出显著提升:

  • Coding: 在 SWE-Bench Pro(公开)上为 54.4%,相较于 GPT-5 mini 的 45.7%。
  • Computer Use: 在 OSWorld-Verified 上为 72.1%,几乎与 GPT-5.4 达到的 75.0% 相匹配。
  • General Intelligence: 在 GPQA Diamond 上为 88.0%,相较于 GPT-5 mini 的 81.6%。
  • Tool Use: 在 Toolathlon 上为 42.9%,在 τ2-bench(电信)上为 93.4%。

多模态与计算机使用能力

GPT-5.4 mini 针对多模态任务进行了优化,尤其是对密集用户界面的解析。它能够快速处理截图以执行计算机使用任务,在 OSWorld-Verified 基准上显著优于 GPT-5 mini。

GPT-5.4 nano:面向低成本任务的优化

GPT-5.4 nano 是 GPT-5.4 系列中体积最小、成本最低的版本。推荐用于高并发、较为简单的支撑任务,例如:

  • 分类
  • 数据提取
  • 排序
  • 处理简单任务的编码子代理

在 GPQA Diamond 基准上,GPT-5.4 nano 达到 82.8%,超过了之前的 GPT-5 mini(81.6%)。

编码工作流与子代理架构

mini 和 nano 两款模型均针对编码工作流中的快速迭代进行了优化,包括调试循环、代码库导航以及前端生成。

子代理模式

OpenAI 强调了一种系统架构:更大的模型充当协调者,而更小的模型充当执行者。在该模式中,类似 GPT-5.4 的模型负责高级规划和最终判断,同时将更细的子任务——如搜索代码库或审阅大型文件——并行委派给 GPT-5.4 mini 子代理。此方法使开发者能够构建在大规模下快速执行且仍保持高层次推理质量的系统。

可用性与定价

GPT-5.4 mini 和 nano 可通过多种 OpenAI 平台获取,规格如下:

GPT-5.4 mini

  • Availability: API、Codex 和 ChatGPT。
  • API Features: 支持文本/图像输入、工具使用、函数调用、网络搜索、文件搜索、计算机使用以及技能。具备 400k 上下文窗口。
  • API Pricing: 每 1M 输入 token $0.75 / 每 1M 输出 token $4.50。
  • Codex Integration: 在应用、CLI、IDE 扩展和网页中均可使用。占用 GPT-5.4 配额的 30%,将简单编码任务的成本降低约三分之二。
  • ChatGPT Integration: 通过 ‘Thinking’ 功能向 Free 和 Go 用户提供;对其他用户而言,作为 GPT-5.4 Thinking 的速率限制回退方案。

GPT-5.4 nano

  • Availability: 仅 API。
  • API Pricing: 每 1M 输入 token $0.20 / 每 1M 输出 token $1.25。

Sources