DeepSeek V4-Pro 发布及全新高峰/非高峰时段 API 定价

DeepSeek V4-Pro 发布带来生产力提升

The V4-Pro 模型现已在 Web/App 界面(通过“专家模式”)和 API 上全面可用。此次发布增加了实质性的智能体(agent)改进,一个可从低(简单任务)到最大(复杂任务)进行缩放的灵活 reasoning effort 设置,以及针对 Codex 集成优化的原生 OpenAI 兼容 Responses API。

全新高峰与非高峰 API 定价将于 2026 年 8 月 16 日生效

DeepSeek 宣布了其 V4 系列的两级定价方案:

  • 高峰时段费率适用于高需求窗口期。
  • 非高峰时段费率比高峰费率低 50%,鼓励用户在较便宜的时段进行工作负载调度。
  • 变更将于 2026 年 8 月 16 日 16:00 UTC 生效。

定价倍数(根据社区提供的表格)

Model Tier Cache Hit Cache Miss Output
V4-Flash Off-peak $0.007 $0.22 $0.66
Peak (×2) $0.014 $0.33 $1.32
V4-Pro Off-peak $0.022 $0.66 $1.98
Peak (×2) $0.044 $0.99 $2.97
Peak Hours 01:00–04:00 UTC 和 06:00–10:00 UTC

“包含基于原价的倍数完整表格:DeepSeek-V4-Flash (off-peak, x2 for peak) … DeepSeek-V4-Pro (off-peak, x2 for peak) … 高峰时段:01:00–04:00 和 06:00–10:00 UTC,自 2026 年 8 月 16 日 16:00 (UTC) 起生效”floppyd

为什么定价策略转变至关重要

  • 成本优化:用户可以通过将非时间敏感的任务路由到非高峰时段,将 token 费用削减高达 50%。
  • 全球需求模式:高峰时段与中国业务时间对齐,这意味着美国和欧洲用户通常可以从更便宜的非高峰时段中受益。
  • 竞争格局:新费率使得 DeepSeek 的 V4-Flash 高峰价格为每百万 output tokens 1.32 美元,明显高于某些竞争对手(例如 OpenRouter 上的 $0.16/M)。这可能会促使用户转向更便宜的替代方案,或鼓励批量处理定价模型。

“我想这对于其他竞争对手来说是个好事。人们很少计算价格涨幅,但价格上涨的事实可能会让他们转向其他供应商。”mateenah

社区反应与见解

  • 地理位置影响:评论者指出,高峰时段对应于中国的工作时间,而非高峰时段则对应于美国/欧盟用户的正常工作时间,这实际上使 DeepSeek 对西方客户来说变得更便宜了。

    “这实际上对美国客户非常有利,因为高峰时段是中国的工作时间,而便宜的时段是美国的正常工作时间。”declan_roberts

  • 定价透明度:用户要求明确的百分比变化;社区已重建了倍数关系,显示高峰期相对于非高峰期大约有 2× 涨幅

    “与价格上涨之前相比,通过 API 使用 V4-Flash 和 V4-Pro 的成本会贵多少?是 2 倍、5 倍还是 10 倍?”alkonaut

  • 自动化潜力:一些人建议构建机器人来延迟请求,以便在非高峰时段执行,从而最大限度地降低成本。

    “如果现在能有一个机器人,能把查询延迟到便宜的时段……”alexthedigger

  • 与其他供应商的对比:一位用户指出 Baseten 的定价似乎比 DeepSeek 官方费率更低,尽管其可持续性尚不确定。

    “现在 Baseten 的定价比官方的还要便宜?可能不会持续,这么有趣的事情发生。 ”flakiness

  • 经济学展望:几位评论者将 token 定价与电力等大宗商品进行类比,预测价格竞争和商品化趋势将持续。

    “Tokens 将会像电力或长途电话分钟数一样,变成一种大宗商品/底部的竞争。”alexpotato

给用户的实用建议

  1. 调度批量任务:将大型、对延迟不敏感的工作负载与非高峰时段(01:00–04:00 UTC, 06:00–10:00 UTC)对齐,以降低一半的成本。

  2. 监控 API 响应:目前,API 并不返回“服务层级”标志来指示高峰/非高峰计费;用户必须根据请求时间戳来推断。

    “API 响应是否包含一个‘service tier’ 响应,用以指示给定请求是否按高峰/非高峰计费?”hopfenspergerj

  3. 比较替代方案:对于成本敏感型项目,评估 OpenRouter, Baseten 或其他供应商,特别是如果高峰定价超过了预算约束。

  4. 自动化延迟:实现客户端逻辑或使用编排工具,将请求排队以在非高峰时段执行。

展望

DeepSeek 的分层定价反映了大型 LLM 推理行业向需求响应型定价的广泛趋势。虽然直接的效果是为非高峰时段使用提供了明确的成本激励,但除非 DeepSeek 引入额外的增值功能或进一步的价格调整,否则较高的高峰费率可能会加速用户向竞争对手的模型迁移。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch