GPT-5.6 の価格とパフォーマンスの更新

OpenAI は GPT-5.6 Luna と Terra の価格を引き下げ、GPT-5.6 Sol 用に「Fast mode」を導入しました。これにより、開発者は高ボリュームの AI ワークロードをよりコスト効果的にスケールさせつつ、優先度の高いタスクを加速させることができます。

API の価格とパフォーマンスの更新

OpenAI は GPT-5.6 モデルファミリーに対して大幅な価格引き下げを実施し、高ボリュームの AI アプリケーションのコストを削減しました。

  • GPT-5.6 Luna: ファミリー内で最も手頃で高速なモデルで、現在価格は 80% 削減されました。API の価格は入力トークン 100 万件あたり $0.20、出力トークン 100 万件あたり $1.20 です。
  • GPT-5.6 Terra: 日常業務向けのバランスの取れたモデルで、現在価格は 20% 削減されました。API の価格は入力トークン 100 万件あたり $2、出力トークン 100 万件あたり $12 です。
  • GPT-5.6 Sol: 価格は変更されませんが、新しい Fast mode が Priority Processing に取って代わります。Fast mode は標準処理に比べ最大 2.5 倍の速度を提供し、価格はその倍ですが、知能に変化はありません。

これらの価格変更は、Codex および ChatGPT Work の有料サブスクリプションに対する使用量のカウント方法にも反映されています。

モデル選択とワークフロー最適化

企業はタスクの具体的なインテリジェンス要件とモデルバージョンをマッチさせることで、AI コストを最適化できます。

  • Luna の効率性: Luna は、1 年前の最先端クラスモデルに匹敵する性能を、タスクあたり約 6 セントのコストで提供し、速度はほぼ 9 倍です。プロフェッショナルな作業(Agents’ Last Exam による測定)において、Luna は Fable 5 を上回り、タスクあたりのコストは約 99% 低減されていると推定されます。
  • ハイブリッドワークフロー: 組織はインテリジェンスに階層的なアプローチを取ることができます。例えば、コーディングワークフローでは、まず GPT-5.6 Sol を使用して計画を策定し不確実性を解消し、その後 GPT-5.6 Luna に切り替えて変更を実装し、テストを実行し、結果を評価するといった流れが考えられます。

効率性の技術的要因

GPT-5.6 の価格対性能の向上は、モデルアーキテクチャ、推論システム、エージェントハーネス全体の改善によって実現されています。

  • インフラストラクチャの改善: ハードウェアの稼働率を維持するためのルーティングの最適化、トークン生成用の生産ソフトウェアの最適化、エージェントが作業を繰り返さないようにするスマートなコンテキスト管理により、効率が向上しています。
  • AI 主導の最適化: GPT-5.6 Sol は人間主導のプロセス内で使用され、プロダクションカーネルを自律的に書き換え最適化し、モデル提供のエンドツーエンドコストを 20% 削減しました。さらに、Sol 主導の実験によりトークン生成効率が 15%以上向上しました。

利用可能性

GPT-5.6 Terra と Luna は ChatGPT Work、Codex、OpenAI API で利用可能です。ChatGPT Work と Codex では、Free および Go ユーザーが Terra にアクセスでき、Plus、Pro、Business、Enterprise ユーザーは Terra と Luna の両方にアクセスできます。価格の更新は 2026 年 7 月 30 日から AWS に展開されます。

Sources