OpenAI GPT-6 Astra 在 OpenRouter 上的定价、性能与社区反响

TL;DR – GPT‑6 Astra 是什么以及为何重要

GPT‑6 Astra 是 OpenAI 针对高要求端到端工作负载的旗舰模型,提供 1 050 000 个 token 的上下文窗口、工具调用功能以及强大的长周期代理能力。其输入 token 价格为每百万 10 美元,输出 token 价格为每百万 50 美元(含缓存折扣),在 OpenRouter 上提供最高的吞吐量(57 tok/s)和最低的延迟(3.38 s),并在多个 Artificial Analysis 基准测试中排名前 5 %。


模型概览

  • 发布日期: 2026 年 9 月 4 日
  • 上下文窗口: 1 050 000 个 token(约 1 M),最多支持 128 000 个完成 token
  • 支持模态: 文本、PDF、图像;通过 tools/tool_choice 实现工具调用
  • 主要应用场景: 高级分析、软件工程、深度研究、科学工作以及涉及浏览器或计算机的长周期代理任务。

定价详情(OpenRouter 列表)

提供商 列出的输入价格 列出的输出价格 缓存读取价格 加权平均输入 加权平均输出
OpenAI Flex $5 / M $25 / M $0.50 / M $2.44 / M $50.08 / M
Azure $10 / M $50 / M $1.00 / M $2.48 / M $51.12 / M
OpenAI (standard) $10 / M $50 / M $1.00 / M
Azure (US) $11 / M $55 / M $1.10 / M $2.52 / M $57.63 / M
OpenAI Fast $20 / M $100 / M $2.00 / M $3.65 / M $105 / M

加权平均值反映了缓存和折扣后的实际使用成本,通常远低于列出的费率。


性能指标(最近 3 天的中位数)

  • 吞吐量: 57 tokens / s(OpenAI Flex,所有提供商中最佳)
  • 延迟(P50): 3.38 s(OpenAI Flex)
  • 端到端延迟: 8.73 s(OpenAI Fast)– 10.14 s(OpenAI Flex)
  • 工具调用错误率: 0.30 %(Azure US)– 4.05 %(OpenAI standard)
  • 结构化输出错误率: 1.54 %(OpenAI)– 8.62 %(Azure)
  • 缓存命中率: 所有提供商约 90 %
  • 可用性(3 天): 整体 100 %;可用性 98.36 %(OpenRouter 在出错时会自动切换到下一个健康提供商)。

基准排名(Artificial Analysis)

基准测试 得分 % 百分位排名
Artificial Analysis Intelligence Index 54.7 % >95 %
Artificial Analysis Coding Index 76.9 % >96 %
Artificial Analysis Agentic Index 51.6 % >91 %
GPQA Diamond(研究生级推理) 96.1 %
HLE(人类最后的考试) 54.7 %
AA‑LCR(长上下文推理) 80.7 %
CritPt(研究级物理) 31.7 %
SciCode(科学 Python) 56.5 %
AA‑Omniscience Accuracy 62.6 %
AA‑Omniscience Non‑Hallucination 48.7 %

所有指标均来自 Artificial Analysis 平台。


现实世界使用信号(顶级应用)

  1. Hermes Agent(Nous Research)– 22.4 亿 token;具有 40 多个工具、跨会话记忆和定时自动化的持久 AI 代理。
  2. Codex – 10.5 亿 token;用于构建和交付软件的代码助手。
  3. Cursor – 10 亿 token;以代码为中心的 IDE 集成。
  4. omp – 86.1 亿 token;未明确的工作流。
  5. Claude Code – 82.8 亿 token;Anthropic 风格的代理式代码工具。

这些高流量应用表明 Astra 正被用于高强度的编码、代理自动化和文档密集型流程。


Hacker News 社区反馈(精选观点)

simonw: “Astra 可能更贵,但如果你的预算为每百万 token 10 美分,你得到的体验远超其他模型。Astra 还能用更少的 token 实现更好的结果。”

jjcm: “视觉能力非常出色——该模型以高保真度重建了复杂的 SVG 设计,远超 Opus 5。”

XCSme: “Astra 的 SVG 生成令人印象深刻;请参见 aibenchy.com 上的并排对比。”

MisterMunchkin: “每百万 token 10 美元 / 50 美元相比中国模型的几美分来说极其昂贵;许多公司正在削减使用量。”

friendlypenguin: “我原本希望 Astra 比 Opus 更便宜,但价格对大多数工作负载来说是个障碍。”

vb‑8448: “在 Codex 应用中,尽管每秒处理速度(TPS)较低,Astra 的感觉比 SOL 还快。”

d2p: “OpenAI 提供商的工具调用失败率较高(约 5 %),而 Azure 的失败率低于 0.5 %。”

frenchtoast8: “OpenRouter 的支持很差——账户会被无理由封禁,且拒绝退款。”

总体情绪:用户称赞 Astra 的能力(尤其是视觉和代理推理),但批评其高昂的价格以及偶尔的可靠性问题(工具调用错误、提供商特定问题、支持响应迟缓)。


开发者实用考虑

  1. 成本效益: 尽管标价较高,但若能利用缓存命中(约 90 %),加权平均成本($2.44 / $50.08 每百万 token)可能更低。需仔细评估 token 使用量;Astra 通常能以更少的 token 达到相同质量。
  2. 提供商选择: Azure 的延迟略高(5.66 s),但工具调用错误率(0.39 %)低于 OpenAI 标准端点(4.05 %)。可使用 OpenRouter 的路由模式(Balanced、Nitro、Exacto)来优先考虑成本、速度或工具调用准确性。
  3. 工具调用: Astra 完全支持函数调用和结构化 JSON 输出。对于关键任务流程,应监控工具调用错误率,并在错误频繁时考虑切换至 Azure 作为备用。
  4. 视觉任务: 社区报告指出,Astra 的图像转 SVG 生成优于以往模型;可用于设计自动化、UI 原型设计或科学图表合成。
  5. 访问层级: Astra 在 OpenRouter 上对 Plus、Pro 和 Business 用户开放,但部分用户报告 Plus 计划存在重置次数有限或限流问题。

如何快速上手(快速启动代码片段)

export OPENROUTER_API_KEY=sk-or-v1-...
curl -N https://openrouter.ai/api/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -d '{
    "model": "openai/gpt-6-astra",
    "stream": true,
    "messages": [{"role": "user", "content": "向一个 10 岁孩子解释量子纠缠"}]
  }'

添加 "reasoning": {"enabled": true} 可接收逐步推理的 token。


展望

GPT‑6 Astra 在长上下文、工具增强推理方面实现了显著进步,使其成为复杂代理工作流的首选模型。其高昂的价格可能限制其在成本敏感型初创企业中的广泛应用,但其在 token 效率和卓越视觉能力方面的优势,可能使其在自动化代码审查、科研助手和设计生成等高价值应用中物有所值。对于生产部署,持续监控提供商可靠性、工具调用错误率以及 OpenRouter 的路由策略至关重要。

Sources

相关