GPT-5.6 价格与性能更新
OpenAI 已降低 GPT-5.6 Luna 和 Terra 的定价,并为 GPT-5.6 Sol 引入了 “Fast mode”,使开发者能够更具成本效益地扩展大规模 AI 工作负载,同时加速高优先级任务。
API 定价与性能更新
OpenAI 已对 GPT-5.6 系列模型实施了显著的降价,以降低大规模 AI 应用的成本。
- GPT-5.6 Luna: 系列中最经济且最快的模型,现已降价 80%。API 定价为每百万输入 token $0.20,每百万输出 token $1.20。
- GPT-5.6 Terra: 适用于日常工作的平衡模型,现已降价 20%。API 定价为每百万输入 token $2,每百万输出 token $12。
- GPT-5.6 Sol: 定价保持不变,但全新 Fast mode 取代了 Priority Processing。Fast mode 的速度比标准处理快最高 2.5 倍,价格为其两倍,智能水平不变。
这些定价变动同样体现在 Codex 和 ChatGPT Work 的付费订阅使用计数方式上。
模型选择与工作流优化
企业可以通过将任务的具体智能需求匹配到相应的模型版本来优化 AI 成本。
- Luna's Efficiency: Luna 的表现相当于一年前的前沿模型,每任务约以 6% 的成本实现,并且速度接近原来的九倍。在专业工作(以 Agents’ Last Exam 为衡量)中,Luna 的每任务估计成本比 Fable 5 低约 99%。
- Hybrid Workflows: 组织可以采用分层的智能方法。例如,编码工作流可以使用 GPT-5.6 Sol 来制定计划并解决不确定性,然后转向 GPT-5.6 Luna 实施更改、运行测试并评估结果。
效率的技术驱动因素
GPT-5.6 的性价比提升源于模型架构、推理系统以及 agentic harness 的多方面改进。
- Infrastructure Improvements: 通过更佳的路由保持硬件高效运行、针对 token 生成的优化生产软件以及更智能的上下文管理以防止 agents 重复工作,从而提升效率。
- AI-Driven Optimization: GPT-5.6 Sol 在人类主导的流程中被用于自主重写和优化生产内核,使模型服务的端到端成本降低了 20%。此外,Sol 主导的实验将 token 生成效率提升了超过 15%。
可用性
GPT-5.6 Terra 和 Luna 已在 ChatGPT Work、Codex 和 OpenAI API 中提供。在 ChatGPT Work 和 Codex 中,Free 和 Go 用户可使用 Terra,而 Plus、Pro、Business 和 Enterprise 用户则可同时使用 Terra 和 Luna。定价更新将于 2026 年 7 月 30 日起在 AWS 推出。