開発者向け GPT-5 リリースノート

OpenAI は API プラットフォームを通じて GPT-5 をリリースし、コーディングと複雑なエージェントタスクに最適化された新しいモデルファミリーを導入しました。GPT-5 はソフトウェアエンジニアリングとツール呼び出しにおいて新たな最先端(SOTA)ベンチマークを確立し、推論努力と応答の冗長性に対する開発者中心の制御を提供します。

最先端のコーディングとフロントエンド機能

GPT-5 はバグ修正、コード編集、複雑なコードベースのナビゲーションが可能なコーディング協働者として設計されています。主要なソフトウェアエンジニアリングベンチマークにおいて、o3 を含む従来のモデルを上回ります。

  • SWE-bench Verified: GPT-5 は 74.9% のスコアを獲得し、o3 の 69.1% を上回りました。高い推論努力の下で、出力トークンを 22% 減らし、ツール呼び出しを 45% 減らすことで達成されました。
  • Aider Polyglot: このモデルは記録的な 88% のスコアを達成し、o3 と比較してエラー率を 3 分の 1 に削減しました。
  • Frontend Development: 社内テストでは、GPT-5 は美的感覚とコード品質の向上により、フロントエンドウェブ開発で o3 よりも 70% の確率で好まれました。

Cursor、Windsurf、Vercel などの早期導入者は、GPT-5 がこれまで使用した中で最も知的なコーディングモデルであり、操作性の容易さと美的フロントエンドタスクにおける高いパフォーマンスを評価しています。

高度なエージェント知能とツール使用

GPT-5 は、長時間にわたるエージェントタスクの実行や、コンテキストを失うことなく複雑なツール呼び出しを連鎖させる点で大幅な改善を示しています。

  • Tool Calling Performance: GPT-5 は τ 2-bench テレコムベンチマークで 96.7% のスコアを獲得し、以前の最先端モデルが 49% を超えたことがなかったのに比べて大幅に向上しました。
  • Instruction Following: このモデルは Scale MultiChallenge(o3-mini による評価)で 69.6%、COLLIE で 99% のスコアを取得しました。
  • Long-Context Retrieval: GPT-5 は OpenAI-MRCR ベンチマークで o3 と GPT-4.1 を上回り、入力長が長くなるほど性能向上が顕著です。BrowseComp Long Context ベンチマーク(128K–256K トークン)では、正解率が 89% です。
  • Context Window: すべての GPT-5 モデルは最大 272,000 入力トークンと 128,000 推論・出力トークンをサポートし、合計で 400,000 トークンのコンテキスト長となります。

開発者制御のための新しい API 機能

OpenAI は、開発者がモデルの挙動をより細かく制御できるよう、いくつかのパラメータとツールタイプを導入しました。

  • reasoning_effort Parameter: 開発者は minimallowmedium(デフォルト)、high の中から選択できるようになりました。minimal 設定は推論時間を最小化し、回答をより速く返します。
  • verbosity Parameter: lowmedium(デフォルト)、high の値を持つ新しいパラメータで、応答の長さを制御します。明示的なプロンプト指示はこの設定を上書きします。
  • Custom Tools: GPT-5 は JSON の代わりにプレーンテキストでツールを呼び出すことをサポートするようになり、長い出力での制御文字エスケープに伴うエラーが減少します。開発者は正規表現や文脈自由文法を用いてこれらのツールを制約できます。
  • Preamble Messages: 指示があれば、GPT-5 はツール呼び出しの前後に可視メッセージを出力し、計画や進捗をエンドユーザーに伝えることができます。

事実性と安全性

GPT-5 は従来のモデルに比べて幻覚(ハルシネーション)が大幅に減少しています。LongFact と FactScore ベンチマークでは、GPT-5 は o3 に比べて約 80% 少ない事実誤りを示します。また、健康関連の質問に対する精度向上と、自身の限界に関する自己認識の向上を目的として特別にチューニングされています。

モデルの提供状況と価格

GPT-5 は 3 つのサイズで提供され、開発者が性能、コスト、レイテンシのバランスを取れるようになっています。また、Responses API、Chat Completions API、そして Codex CLI のデフォルトとしても利用可能です。

モデル 入力価格(1M トークンあたり) 出力価格(1M トークンあたり)
gpt-5 $1.25 $10.00
gpt-5-mini $0.25 $2.00
gpt-5-nano $0.05 $0.40

さらに、ChatGPT で使用される非推論バージョンは gpt-5-chat-latest(入力 $1.25 / 出力 $10.00)として利用可能です。GPT-5 は Azure AI Foundry、GitHub Copilot、Microsoft 365 Copilot など、Microsoft の各プラットフォームでも展開されています。

Sources