DeepSeek V4-Pro リリースと新しいピーク/オフピークAPI料金体系

DeepSeek V4‑Pro の提供開始によるプロダクションへの恩恵

DeepSeek V4‑Pro モデルは、ウェブ/アプリインターフェース(「Expert Mode」経由)およびAPIの両方で一般提供が開始されました。このリリースにより、エージェント機能の大幅な改善、低負荷(単純なタスク)から最大(複雑なタスク)までスケールする柔軟な reasoning effort 設定、およびCodex統合に最適化されたOpenAI互換のResponses APIが追加されました。

新しいピークおよびオフピークAPI料金体系が2026年8月16日に適用開始

DeepSeekは、V4ラインナップに対して2段階の料金体系を発表しました:

  • ピーク料金は、需要の高い時間帯に適用されます。
  • オフピーク料金は、ピーク料金の50%低く、安価な時間帯へのワークロードのスケジューリングを促します。
  • この変更は、2026年8月16日 16:00 UTCに有効になります。

料金倍率(コミュニティ提供の表より)

Model Tier Cache Hit Cache Miss Output
V4‑Flash Off‑peak $0.007 $0.22 $0.66
Peak (×2) $0.014 $0.33 $1.32
V4‑Pro Off‑peak $0.022 $0.66 $1.98
Peak (×2) $0.044 $0.99 $2.97
Peak Hours 01:00–04:00 UTC and 06:00–10:00 UTC

“Full table with multipliers from previous prices: DeepSeek‑V4‑Flash (off‑peak, x2 for peak) … DeepSeek‑V4‑Pro (off‑peak, x2 for peak) … Peak Hours: 01:00–04:00 and 06:00–10:00 UTC Effective from: 16:00, August 16, 2026 (UTC)” – floppyd

なぜ料金体系の変更が重要なのか

  • コスト最適化: ユーザーは、時間的に重要でないジョブをオフピーク時間帯にルーティングすることで、トークン費用を最大50%削減できます。
  • グローバルな需要パターン: ピーク時間帯は中国のビジネス時間と一致しており、米国や欧州のユーザーは、安価なオフピーク時間帯の恩恵を受けることが多いです。
  • 競争環境: 新しい料金体系により、DeepSeekのV4‑Flashのピーク料金は出力トークン100万個あたり$1.32となり、一部の競合他社(例:OpenRouterの$0.16/M)よりも著しく高くなります。これは、ユーザーをより安価な代替案へ誘導したり、一括バッチ処理料金モデルへの移行を促したりする可能性があります。

“This is good for other competitors I guess. People rarely calculate the bump in price but the fact that price is increasing might bring them to other vendors.” – mateenah

コミュニティの反応と洞察

  • 地理的影響: コメンテーターは、ピーク時間帯が中国の労働時間に対応しており、米国/EUユーザーはオフピークを通常の業務時間として捉えているため、実質的にDeepSeekを欧米の顧客にとってより安価にしていると指摘しています。

    “This actually works out favorably for US customers since the peak hours are Chinese working hours and cheap hours are US working hours.” – declan_roberts

  • 料金の透明性: ユーザーは明示的なパーセンテージの変化を要求しています。コミュニティは倍率を再構成し、ピーク対オフピークで概ね 2×倍増 していることを示しています。

    “Roughly how much more expensive is it to work with V4‑Flash and V4‑Pro through the API, compared to before the price increases? Is it 2x, 5x, 10x higher?” – alkonaut

  • 自動化の可能性: 一部のユーザーは、コストを最小限にするために、リクエストをオフピーク時間帯に遅延させるボットを構築することを提案しています。

    “Now if there could be a bot that defers queries until it’s cheap…” – alexthedigger

  • 他社との比較: あるユーザーは、Basetenの料金がDeepSeekの公式料金よりも低く見えると指摘しています。持続可能性は不明ですが、継続的な比較が重要です。

    “Now Baseten's pricing is cheaper than the official one? Probably won't last, but still interesting.” – flakiness

  • 経済的展望: 複数のコメントが、トークン料金を電気などのコモディティ(汎用品)になぞらい、継続的な価格競争とコモディティ化が進むと予測しています。

    “Tokens are going to be like electricity or long distance phone minutes where it just becomes a commodity/race to the bottom.” – alexpotato

ユーザーへの実用的なヒント

  1. バッチジョブのスケジューリング: コストを半減させるために、大きな、レイテンシに寛容なワークロードをオフピーク時間帯(01:00–04:00 UTC, 06:00–10:00 UTC)に合わせてスケジューリングしてください。
  2. APIレスポンスの監視: 現時点では、APIはピーク/オフピークの請求に関する「サービスティア」フラグを返しません。ユーザーはリクエストのタイムスタンプに基づいて判断する必要があります。

    “Does the API response include a ‘service tier’ response to indicate whether you paid peak/off‑peak for a given request?” – hopfenspergerj

  3. 代替案の比較: コストに敏感なプロジェクトでは、OpenRouter、Baseten、またはその他のプロバイダーを評価してください。特にピーク料金が予算制約を超えてしまう場合に有効です。
  4. 自動化による遅延: クライアント側でロジックを実装するか、オーケストレーションツールを使用して、リクエストをオフピーク実行用にキューに溜める仕組みを構築してください。

Outlook

DeepSeekの段階的料金体系は、大規模LLM推論における需要に応じた動的な料金体系への業界全体の動きを反映しています。DeepSeekが追加の付加価値機能やさらなる価格調整を導入しない限り、DeepSeekのV4‑Pro リリースと新しいピーク/オフピークAPI料金体系は、即座的なコストインセンティブとしてオフピーク利用を業務に活用する即座的な恩恵を与えますが、高いピーク料金は、競合モデルへの移行を加速させる可能性があります。

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch