OpenAIがChatGPTエージェントを紹介

OpenAIはChatGPTエージェントを発表しました。このシステムは独自の仮想コンピュータを操作して、複雑でエンドツーエンドのタスクを実行できるものです。Operatorのウェブ操作機能、deep researchの統合スキル、ChatGPTの会話流暢性を組み合わせることで、エージェントはウェブサイトをナビゲートし、コードを実行し、スライドショーやスプレッドシートといった編集可能なプロフェッショナルな成果物を提供できます。

統合エージェントアーキテクチャ

ChatGPTエージェントは、以前は別々だった3つの機能を単一のモデルに統合した統一システム上に構築されています。この統合により、エージェントは推論と行動をシームレスに切り替えることができ、Operatorが深い分析力に欠けていた点や、deep researchがウェブサイトとやり取りしたり認証コンテンツを扱う能力がなかった点といった従来の制限を克服します。

ツールスイートと技術的実行

タスクを実行するために、エージェントは特定のツール群を備えた仮想コンピュータを利用します:

  • Visual Browser: 人間中心のウェブサイト向けに、グラフィカルユーザーインターフェース(GUI)でウェブと対話します。
  • Text-based Browser: シンプルで推論中心のウェブクエリを効率的に処理します。
  • Terminal: コマンドを実行し、コードを走らせます。
  • Direct API Access: 構造化データ取得のためにサービスへ接続します。
  • ChatGPT Connectors: GitHubやGmailなどのアプリと統合し、ユーザー固有の情報へアクセスします。

このアーキテクチャにより、モデルはタスクに最も効率的な経路を選択できます。たとえば、APIでカレンダー情報を取得し、テキストブラウザでテキストを推論し、最終的な実行はGUIで行う、といった組み合わせが可能です。

パフォーマンスベンチマーク

ChatGPTエージェントは、複数の専門レベルおよび実世界ベンチマークで最先端(SOTA)性能を示します:

  • Humanity’s Last Exam (HLE): パス@1 SOTAスコア41.6を達成し、並列ロールアウト戦略(8回試行)を使用すると44.4に上昇します。
  • FrontierMath: ターミナルアクセスでコード実行を行い、27.4%の正確度を記録し、従来モデルを大幅に上回ります。
  • BrowseComp: 68.9%の新SOTAを設定し、deep researchより17.4ポイント向上しました。
  • SpreadsheetBench: スプレッドシートを直接編集できる状態で45.5%のスコアを取得し、ExcelのCopilotの20.0%を上回ります。
  • WebArena: Operatorを動かすo3モデルに対して改善を示しました。
  • Investment Banking Tasks: レバレッジド・バイアウトモデルなど、1年から3年目のアナリスト業務タスクにおいて、deep researchやo3を大きく上回ります。
  • Knowledge Work: 経済的に価値のある知識作業タスクの内部ベンチマークで、エージェントの出力は約半数のケースで人間と同等かそれ以上でした。

ユーザーコントロールと協働ワークフロー

ChatGPTエージェントは、完全に自律的に動作するのではなく、反復的な協働を前提に設計されています。ユーザーは以下の仕組みでコントロールを保持します:

  • Interruption and Takeover: ユーザーは任意の時点でエージェントを中断し、指示を明確にしたり、ログイン処理や結果の方向付けのためにブラウザを手動で操作できます。
  • Permission-based Actions: エージェントは購入など現実世界に影響を与える行動を取る前に、明示的な許可を求めるよう訓練されています。
  • Watch Mode: メール送信などの重要タスクは、ユーザーのアクティブな監視が必要です。
  • Notifications: モバイルアプリユーザーはタスク完了時に通知を受け取ります。
  • Scheduling: ユーザーは完了したタスクを自動的に定期実行(例:週次レポート)できるようスケジュールできます。

安全性とリスク緩和

OpenAIは、ウェブ上で直接行動できるエージェントのリスクプロファイル拡大に対応するため、包括的な安全スタックを実装しています。

敵対的操作とプロンプトインジェクション

エージェントはライブウェブコンテンツに触れるため、プロンプトインジェクション—ウェブページに隠された悪意ある指示がエージェントにプライベートデータの共有や有害行動を取らせる—のリスクがあります。緩和策は以下です。

  • プロンプトインジェクションを識別し抵抗するための専門的な訓練。
  • 攻撃検出のための継続的モニタリング。
  • 重要な行動には明示的なユーザー確認が必要です。

モデルのミスとデータプライバシー

自律的なエラーを防ぐため、エージェントは銀行振込など高リスクタスクを事前に拒否します。プライバシーは「テイクオーバーモード」で管理され、パスワード等の入力はプライベートに保たれ、モデルに収集・保存されません。ユーザーはワンクリックで全閲覧データを削除し、すべてのセッションからログアウトできます。

生物学的・化学的リスク

Preparedness Frameworkの下、ChatGPTエージェントは「高い生物学的・化学的能力」を持つと分類されます。これにより、デュアルユース拒否訓練、推論モニタ、常時オンの分類器を含む包括的な安全スタックが発動します。

利用可能性と制限

ChatGPTエージェントは現在、ツールドロップダウンの「エージェントモード」オプションを通じてPro、Plus、Teamユーザーに展開中です。EnterpriseおよびEducationユーザーへの提供は数週間以内に開始されます。Proユーザーは月400メッセージに制限され、他の有料ユーザーは月40メッセージが付与されます。

Current Limitations:

  • Slideshow Creation: 現在ベータ版です。フォーマットや仕上げは粗く、既存スライドショーをテンプレートとしてアップロードする機能は(スプレッドシートとは異なり)現時点でサポートされていません。
  • Regional Availability: スイスおよび欧州経済領域(EEA)へのアクセスはまだ有効化中です。

Sources