GPT-5.6 Sol、Terra、Luna:パフォーマンス、機能、利用可能性
GPT-5.6 Sol、Terra、Luna:パフォーマンス、機能、利用可能性
TL;DR
OpenAIはGPT‑5.6ファミリーをリリースしました—フラッグシップのSol、バランスの取れたモデルのTerra、最もコスト効率の高いLuna—トークンあたりの知能を向上させ、複数エージェントを並列に実行する新しいultra設定、そしてこれまでで最も堅牢な安全システムを提供します。
モデルファミリー概要
GPT‑5.6は3つの階層から構成されます:Sol、Terra、Luna。Solは高負荷作業向けのフラッグシップモデル、Terraは日常タスク向けにバランスの取れた性能を提供し、Lunaは最速かつ最低コストのオプションです。3つすべてが同じ世代番号を共有しつつ、階層名は独立して進化できる耐久的な能力レベルを示しています。
パフォーマンスと効率の向上
GPT‑5.6 Solは、コーディング、知識作業、サイバーセキュリティ、科学の各分野で最先端の結果を達成し、従来および競合の最前線モデルよりもトークン使用量が少なく、推定コストも低く抑えます。Agents’ Last ExamではSolが53.6点を取得し、Claude Fable 5を13.1点上回ります。中程度の推論ではFable 5を11.4点上回り、推定コストは約4分の1です。TerraとLunaもそれぞれ約16分の1のコストでFable 5を上回ります。Artificial Analysis Intelligence Indexでは、max推論時のSolがFable 5に1点差で迫りつつ、タスク完了時間を61%短縮し、推定コストは約半分です。
コーディングの卓越性
GPT‑5.6 SolはArtificial Analysis Coding Agent Indexで80点という新たな最先端スコアを記録し、Claude Fable 5を2.8点上回ります。出力トークンは半分未満、処理時間も半分未満で、コストは約3分の1です。TerraはFable 5をわずかに上回り、LunaはClaude Opus 4.8を上回ります。いずれも処理時間は約3分の1、出力トークンは約半分、推定コストは約4分の1です。さらに、SolはTerminal‑Bench 2.1とDeepSWEでも新たな最先端結果を示し、複雑なコマンドラインワークフローや実コードベースでの長期エンジニアリングを評価します。
知識作業とデザイン判断
GPT‑5.6 SolはBrowseCompで92.2%、OSWorld 2.0で62.6%を達成し、Claude Opus 4.8を上回りますが、出力トークンは85%削減しています。モデルは自然言語のリクエストをChatGPT Work内で洗練されたインタラクティブな説明や可視化に変換できます。Slack、Notion、Microsoft 365、Google Driveから散在したコンテキストを抽出し、専門レベルで共有可能な成果物に変換します。プレゼンテーション、文書、スプレッドシートにおいて、Solはより洗練され正確な出力を生成し、ゼロから完全に編集可能なプレゼンテーションを作成でき、スライドのデザインシステム(レイアウト、タイポグラフィ、間隔、色、繰り返しコンテンツパターン)を推測して新規素材に忠実に適用します。
サイバーセキュリティ機能と安全性
ExploitBenchでは、GPT‑5.6 Solが73.5%を記録し、GPT‑5.5の47.9%を大きく上回ります。ExploitGymでは、2時間上限で15.1%から24.9%へ、6時間で33.7%へと、GPT‑5.5の最高合格率をほぼ2倍に引き上げました。SEC‑Bench Proでは、改善されたレイテンシで71.2%を達成し、GPT‑5.5の45.8%を上回ります。モデルは安全なコードレビュー、パッチ適用、脅威モデリング、ブルーチーム活動といった防御タスクをサポートし、OpenAI DaybreakのTrusted Accessプログラムを通じて検証済みアクセスを提供します。GPT‑5.6の安全対策はこれまでで最も堅牢で、モデルに組み込まれた保護とリアルタイムチェック、継続的モニタリング、アカウントレベルの強制を組み合わせ、会話を潜在的な危害についてレビューする推論モニタも付加しています。従来モデルと比較して、Solのサイバー安全機能は有害な活動を約10倍多くブロックし、低能力モデルへのプロンプト再試行オプションにより、無害な利用時の摩擦を軽減します。
Ultra とマルチエージェントワークフロー
ultra設定はデフォルトで4つのエージェントを並列に調整し、トークン使用量は増えるものの、要求の高いタスクでより強力な結果と高速なタイム・トゥ・リザルトを実現します。チャートは、並列エージェントを追加することでBrowseComp、SEC‑Bench Pro、Terminal‑Bench 2.1におけるスコア‑レイテンシ境界が上方左方にシフトすることを示しており、16エージェント構成も実証されています。開発者はResponses APIのマルチエージェントベータを利用してultraに似た体験を構築できます。max設定はxhighよりも推論時間を多く提供し、モデルが代替案を探索し、チェックを実行し、アプローチを修正できるようにします。
利用可能性、アクセス、価格設定
GPT‑5.6 Sol、Terra、Lunaは本日からChatGPT、Codex、OpenAI APIで利用可能となり、グローバル展開は今後24時間で完全提供を目指します。ChatGPTでは、Plus、Pro、Business、Enterpriseユーザーが中程度以上のエフォート設定でSolにアクセスでき、ProとEnterpriseは最高品質の結果を得るためにSol Proも選択可能です。FreeとGoユーザーはChatGPT WorkとCodexでTerraにアクセスでき、Plus、Pro、Business、EnterpriseはSol、Terra、Lunaを選択し、各モデルのエフォートレベルを設定できます。maxトグルはChatGPT WorkとCodexでアクセス権を持つ全ユーザーが利用可能で、ultraはChatGPT WorkのPro・Enterpriseユーザー、CodexのPlus以上のプランで利用できます。API開発者はOpenAI API経由で3つの階層すべてにアクセスでき、Responses APIのProgrammatic Tool Callingによりツールを連携させたインメモリプログラムを書き実行でき、マルチエージェントベータでサブエージェントを同時実行できます。1Mトークンあたりの価格は:Sol $5(入力)/$30(出力);Terra $2.50(入力)/$15(出力);Luna $1(入力)/$6(出力)。プロンプトキャッシュは明示的なキャッシュブレークポイントと30分の最小キャッシュ寿命により予測可能になり、キャッシュ書き込みは非キャッシュ入力レートの1.25倍で課金され、キャッシュ読み取りは入力コストの90%割引が適用されます。
結論
GPT‑5.6は、パフォーマンス‑ドル比のフロンティアを押し上げ、超規模マルチエージェント推論を導入し、コーディング、知識作業、デザイン判断、サイバーセキュリティ防御を向上させ、これらの進化をOpenAIがこれまでに展開した最も包括的な安全システムと組み合わせたモデルファミリーを提供します。