OpenAI GPT-5.2-Codex システムカード付録

OpenAIは、エージェント型コーディングに最適化されたGPT-5.2の専門バージョンであるGPT-5.2-Codexをリリースしました。このモデルは、プロジェクト規模のリファクタリングやマイグレーション、Windows環境でのパフォーマンス向上など、複雑で実際のソフトウェアエンジニアリング向けに設計されています。

技術的改善と機能

GPT-5.2-Codexは、長期的な作業とプロジェクト規模のソフトウェアエンジニアリングに焦点を当てています。主な技術的強化点は以下の通りです:

  • Context Compaction: モデルはコンテキスト圧縮を利用して、長期的なタスクを処理する能力を向上させます。
  • Project-Scale Tasks: GPT-5.2-Codexは、コードベースのリファクタリングやマイグレーションなど、大規模なエンジニアリングタスクでより高いパフォーマンスを示します。
  • Environment Optimization: モデルは特にWindows環境でのパフォーマンスが向上しています。
  • Cybersecurity: モデルは前バージョンに比べて、サイバーセキュリティ機能が大幅に強化されています。

安全性と緩和策

OpenAIは、モデルの安全な展開を確保するために包括的な安全対策を実装しました。これらはモデルレベルとプロダクトレベルの緩和策に分かれています:

  • Model-Level Mitigations: これには、有害なタスクへの支援を防止し、プロンプトインジェクションに抵抗するための専門的な安全トレーニングが含まれます。
  • Product-Level Mitigations: これには、エージェントのサンドボックス化や、誤用の可能性を制限するための設定可能なネットワークアクセスが含まれます。

準備フレームワーク評価

GPT-5.2-Codexは、OpenAIの準備フレームワークに基づき、重要なリスク閾値を評価しました。評価結果は以下の通りです:

  • Cybersecurity: モデルはサイバーセキュリティ分野で「非常に有能」と評価されていますが、「高い能力」閾値には達していません。OpenAIは近い将来、モデルがこの閾値を超えることを期待しています。
  • Biology: モデルは生物学において「高い能力」を有するとみなされており、GPT-5ファミリーの他のモデルと一致し、対応する安全策とともに展開されています。
  • AI Self-Improvement: モデルはAI自己改善に関して「高い能力」閾値に達していません。

Sources