OpenRouter 将 GPT-5.6 Sol API 定价下调 50% – 影响与社区反应
GPT-5.6 Sol 50% 折扣现已生效
OpenRouter 市场现在列出 GPT-5.6 Sol 的价格为 每 100 万输入 token 2.50 美元,每 100 万输出 token 15 美元,相比标准 OpenAI 定价降低了 50%。该折扣仅适用于 OpenRouter 上的 标准 OpenAI 提供商路由;其他提供商(Azure、Amazon Bedrock)仍维持较高费率。
- 发布日期: 2026 年 7 月 9 日
- 上下文窗口: 100 万 token
- 加权平均有效价格: 每 100 万输入 token 0.889 美元,每 100 万输出 token 21.24 美元(反映缓存命中率和折扣)
- 最近 3 天的正常运行时间: 100%(可用性 99.80%)
- 最佳吞吐量: 80 token/s(Amazon Bedrock 美国)
- 最佳延迟: 2.07 秒(Amazon Bedrock 美国)
OpenRouter 的定价页面还显示了一张 价格历史图表,表明 OpenAI 提供商的新标价(输入 2.50 美元,输出 15 美元),缓存命中率为 87.6%。
性能亮点
| 指标 | 最佳提供商 | 数值 |
|---|---|---|
| GPQA Diamond(研究生级科学推理) | OpenAI(自动路由) | 91.4% |
| TAU-Bench(航空公司场景) | Azure(欧洲) | 80.0% |
| 工具调用错误率 | Azure(美国) | 0.62% |
| 结构化输出错误率 | OpenAI | 1.43% |
| 端到端延迟(平均) | OpenAI | 8.90 秒 |
该模型在 Artificial Analysis Intelligence Index 上排名 96%,在 Coding Index 上排名 98%,在 Agentic Index 上排名 97%。
现实世界使用信号
通过 GPT-5.6 Sol 路由的顶级流量应用包括:
- Codex – 一个代码助手(处理了 3680 亿 token)
- Hermes Agent – 一个开源持久化 AI 代理(处理了 2010 亿 token)
- pi – 一个个人代码代理(处理了 1610 亿 token)
- Claude Code – Anthropic 的代码编辑工具(处理了 614 亿 token)
- OpenClaw – 一个由 AI 驱动的 Messaging/Automation 代理(处理了 527 亿 token)
这些工作负载展示了该模型在多步骤编码、工具使用和长上下文推理方面的优势。
Hacker News 社区反应
此次降价引发了热烈讨论(447 条评论)。以下是按主题归类的最具代表性的观点。
对能力与成本的赞扬
"太棒了,它是一个极其强大的模型,思考时使用的 token 和时间都少得多……我可能终于要取消我的 Claude 订阅了。" – netsec_burn
"这真的令人印象深刻。在推出如此强大的模型的同时将价格下调 50%,正是让先进 AI 真正变得可及的举措。" – wahid_seddiqi
对价值与订阅计划的怀疑
"即使在这些价格下,从补贴订阅转向 API 也并不值得。根本不是一回事。" – therepanic
"标题看起来具有误导性;折扣仅适用于 OpenRouter,不适用于原生 OpenAI API。" – OutOfHere
对市场动态的担忧
"价格战曾让许多行业受益,比如中国的共享单车行业。但如今,是数据机房过度扩张,还是成堆的 GPU 被扔进海里?" – m4rtink
"这仅仅是全面 token 价格战的开端。模型正变得像商品一样;我们很可能会看到价格趋近于计算成本。" – cmiles8
"Stripe 最近以超过 70 亿美元收购了 OpenRouter。我敢打赌,这正是背后的原因!" – dvrp
对折扣范围的疑问
"这个定价变动是否仅限于 OpenRouter?我看不到 OpenAI 官方关于此事的任何信息。" – krzyk
"如果他们将 Sol 降价 50%,而 Luna 降价 80%,那原始价格一定有极高的运营利润率。" – z_rho_one
"我的理解是,这只是一个噱头,他们只是以 OpenAI 灵活套餐相同的折扣提供 OpenAI 灵活套餐,然后回退到 Azure。" – lyjackal
对模型质量的混合体验
"5.6-Sol 感觉像是倒退;相比早期模型,它在简单问题上耗时极长。" – jeffybefffy519
"我让它写一个待办事项清单,结果得到一篇四页的论文;而 5.4 给出的是简洁的列表。" – vorpalhex
"我喜欢这种向下的竞赛;如果 Sol 不是最佳模型,它也处于前列。你不会无缘无故地降低最佳模型的价格。" – onlyrealcuzzo
技术澄清
"稍微不相关:'tps' 值是怎么回事?GPT-5.6 Sol 真的只能达到每秒 32 个 token 吗?" – egorfine
"订阅积分使用是否有任何变化?" – matheusmoreira
对用户而言,此次折扣意味着什么
- 高能力工作负载的入门成本降低 – 以每 100 万输入 token 2.50 美元的价格,开发者可以无需面对此前 5 美元/100 万的门槛,即可尝试复杂的推理、多步骤编码和代理式流水线。
- 可能转向 OpenRouter 作为主要接入点 – 由于折扣仅限于 OpenRouter 的路由模式,启用 ZDR-only 切换(强制 OpenAI 灵活定价)的用户可能会错过折扣,从而促使流量向标准路由迁移。
- 缓存命中带来的优势 – 加权平均有效输入价格(0.889 美元/100 万)远低于标价 2.50 美元,表明频繁使用缓存可进一步降低重复提示的成本。
- 竞争压力加剧 – 中国模型如 Kimi K3 和 DeepSeek v4 在更低价格点上表现出相当的品质,表明 OpenAI 正在应对全球性的定价军备竞赛。
如何开始使用
export OPENROUTER_API_KEY=sk-or-v1-...
curl -N https://openrouter.ai/api/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-d '{
"model": "openai/gpt-5.6-sol",
"stream": true,
"messages": [{"role": "user", "content": "向一个 10 岁孩子解释量子纠缠"}]
}'
OpenRouter SDK(TypeScript、Python、Go)支持与 OpenAI API 相同的请求格式;只需将基础 URL 替换为 https://openrouter.ai/api/v1 即可。
总结
OpenRouter 的 50% 降价使 GPT-5.6 Sol 成为该平台上最实惠的旗舰 OpenAI 模型,但该折扣仅限于 OpenRouter 的路由层级,不影响原生 OpenAI 定价。社区情绪从对普及高端 LLM 能力的兴奋,到对在激烈竞争和即将到来的 token 价格战背景下此类折扣长期可持续性的怀疑不等。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch