開発者向け GPT-5 リリースノート
OpenAI は API プラットフォームを通じて GPT-5 をリリースし、コーディングと複雑なエージェントタスクに最適化された新しいモデルファミリーを導入しました。GPT-5 はソフトウェアエンジニアリングとツール呼び出しにおいて新たな最先端(SOTA)ベンチマークを確立し、推論努力と応答の冗長性に対する開発者中心の制御を提供します。
最先端のコーディングとフロントエンド機能
GPT-5 はバグ修正、コード編集、複雑なコードベースのナビゲーションが可能なコーディング協働者として設計されています。主要なソフトウェアエンジニアリングベンチマークにおいて、o3 を含む従来のモデルを上回ります。
- SWE-bench Verified: GPT-5 は 74.9% のスコアを獲得し、o3 の 69.1% を上回りました。高い推論努力の下で、出力トークンを 22% 減らし、ツール呼び出しを 45% 減らすことで達成されました。
- Aider Polyglot: このモデルは記録的な 88% のスコアを達成し、o3 と比較してエラー率を 3 分の 1 に削減しました。
- Frontend Development: 社内テストでは、GPT-5 は美的感覚とコード品質の向上により、フロントエンドウェブ開発で o3 よりも 70% の確率で好まれました。
Cursor、Windsurf、Vercel などの早期導入者は、GPT-5 がこれまで使用した中で最も知的なコーディングモデルであり、操作性の容易さと美的フロントエンドタスクにおける高いパフォーマンスを評価しています。
高度なエージェント知能とツール使用
GPT-5 は、長時間にわたるエージェントタスクの実行や、コンテキストを失うことなく複雑なツール呼び出しを連鎖させる点で大幅な改善を示しています。
- Tool Calling Performance: GPT-5 は τ 2-bench テレコムベンチマークで 96.7% のスコアを獲得し、以前の最先端モデルが 49% を超えたことがなかったのに比べて大幅に向上しました。
- Instruction Following: このモデルは Scale MultiChallenge(o3-mini による評価)で 69.6%、COLLIE で 99% のスコアを取得しました。
- Long-Context Retrieval: GPT-5 は OpenAI-MRCR ベンチマークで o3 と GPT-4.1 を上回り、入力長が長くなるほど性能向上が顕著です。BrowseComp Long Context ベンチマーク(128K–256K トークン)では、正解率が 89% です。
- Context Window: すべての GPT-5 モデルは最大 272,000 入力トークンと 128,000 推論・出力トークンをサポートし、合計で 400,000 トークンのコンテキスト長となります。
開発者制御のための新しい API 機能
OpenAI は、開発者がモデルの挙動をより細かく制御できるよう、いくつかのパラメータとツールタイプを導入しました。
reasoning_effortParameter: 開発者はminimal、low、medium(デフォルト)、highの中から選択できるようになりました。minimal設定は推論時間を最小化し、回答をより速く返します。verbosityParameter:low、medium(デフォルト)、highの値を持つ新しいパラメータで、応答の長さを制御します。明示的なプロンプト指示はこの設定を上書きします。- Custom Tools: GPT-5 は JSON の代わりにプレーンテキストでツールを呼び出すことをサポートするようになり、長い出力での制御文字エスケープに伴うエラーが減少します。開発者は正規表現や文脈自由文法を用いてこれらのツールを制約できます。
- Preamble Messages: 指示があれば、GPT-5 はツール呼び出しの前後に可視メッセージを出力し、計画や進捗をエンドユーザーに伝えることができます。
事実性と安全性
GPT-5 は従来のモデルに比べて幻覚(ハルシネーション)が大幅に減少しています。LongFact と FactScore ベンチマークでは、GPT-5 は o3 に比べて約 80% 少ない事実誤りを示します。また、健康関連の質問に対する精度向上と、自身の限界に関する自己認識の向上を目的として特別にチューニングされています。
モデルの提供状況と価格
GPT-5 は 3 つのサイズで提供され、開発者が性能、コスト、レイテンシのバランスを取れるようになっています。また、Responses API、Chat Completions API、そして Codex CLI のデフォルトとしても利用可能です。
| モデル | 入力価格(1M トークンあたり) | 出力価格(1M トークンあたり) |
|---|---|---|
gpt-5 |
$1.25 | $10.00 |
gpt-5-mini |
$0.25 | $2.00 |
gpt-5-nano |
$0.05 | $0.40 |
さらに、ChatGPT で使用される非推論バージョンは gpt-5-chat-latest(入力 $1.25 / 出力 $10.00)として利用可能です。GPT-5 は Azure AI Foundry、GitHub Copilot、Microsoft 365 Copilot など、Microsoft の各プラットフォームでも展開されています。
Sources
- OriginalIntroducing GPT-5 for developers