OpenAI o3 と o4-mini のリリースノート
OpenAI o3 と OpenAI o4-mini は、最先端の推論と包括的なツール機能(ウェブ閲覧、Python、画像・ファイル解析、画像生成、キャンバス、オートメーション、ファイル検索、メモリ)を統合した推論モデルです。これらのモデルは、複雑な数学、コーディング、科学的課題を解決しながら、強力な視覚認識と分析を提供するよう設計されています。
思考連鎖におけるツール統合
OpenAI o3 と o4-mini は、思考連鎖の中でツールを直接利用することで推論プロセスを拡張します。これにより、画像の切り抜きや変換、ウェブ検索、Python コードの実行によるデータ解析などのアクションを、最終的な回答に至る前の内部熟考プロセスで行うことが可能になります。
訓練と安全アラインメント
o 系列モデルは、思考連鎖に対する大規模強化学習を用いて訓練されています。この訓練手法により「熟考アラインメント」が実現され、モデルは潜在的に危険なプロンプトに応答する際にコンテキスト内で安全ポリシーを考慮できるようになり、全体的なロバスト性と安全性が向上します。
準備フレームワークとリスク評価
このリリースは、OpenAI の準備フレームワーク Version 2 の下で評価された初めてのものです。安全諮問グループ(SAG)は、3 つの追跡カテゴリにわたる評価をレビューしました。
- 生物・化学能力: リスクの高い閾値には達しませんでした。
- サイバーセキュリティ: リスクの高い閾値には達しませんでした。
- AI 自己改善(サイバーセキュリティ): リスクの高い閾値には達しませんでした。
OpenAI は、o3 と o3-mini が安全諮問グループが設定した安全閾値を遵守していると報告しています。