OpenAI Presence: エンタープライズ向け AI エージェント デプロイメント フレームワーク

OpenAI Presence: エンタープライズ向け AI エージェント デプロイメント フレームワーク

OpenAI は、問題の解決、社内システムの使用、承認されたアクションの実行が可能な信頼できる AI エージェントを企業がデプロイできるよう支援する製品である OpenAI Presence を発表しました。このシステムは、信頼性、ポリシー遵守、制御された適応が求められる高価値の本番環境へ、実験的な概念実証から AI エージェントを移行する課題に対処します。

本番環境対応エージェントの機能

OpenAI Presence は、請求問題の解決、保険請求のサポート、従業員の IT サービスリクエストの管理など、特定の高価値ワークフロー向けのエージェントのデプロイを可能にします。これらのエージェントは、音声およびチャットの両チャネルにデプロイされ、カスタマーサポート、アウトバウンドセールス、高リスクの内部ワークフローなどのユースケースをサポートします。

信頼性を確保するため、Presence は次のコンポーネントの組み合わせを利用します:

  • ポリシーと SOP: エージェントが何ができるか、および人間の承認が必要となるタイミングを規定するルール。
  • ガードレール: インタラクションが確立された企業の境界を外れたときに介入するシステム。
  • 承認済みアクション: エージェントが実行できる特定で承認されたシステムとの相互作用。
  • エスカレーションルール: エージェントが人間のオペレーターにセッションを引き継ぐべき明確なトリガー。
  • 知識とシステムアクセス: エージェントは、特定の職務に必要な知識とシステムアクセスのみに制限されます。

Codex を駆動する改善ループ

OpenAI Presence の中心的な機能は、制御を犠牲にすることなく、変化するユーザー行動、製品、ポリシーに適応できる能力です。このシステムは、リリース後のパフォーマンスを維持するために Codex を駆動する改善プロセスを使用します:

  1. シグナル検出: 本番セッション、エスカレーション、品質シグナルを監視し、エージェントのパフォーマンスのギャップを特定します。
  2. 更新案: Codex がこれらのシグナルを調査し、エージェントの設定に対する具体的な更新案を提案します。
  3. テストと承認: チームは、制御されたロールアウトを承認する前に、現在の本番バージョンと提案された変更をテストできます。

パフォーマンスベンチマークと企業導入

OpenAI は、自社の英語電話サポート(1-888-GPT-0090)を Presence で駆動しています。OpenAI の発表によると、この導入により以下の成果が得られました:

  • 解決率: エージェントは人間の支援なしで受信問題の 75% を解決します。
  • 品質: 数週間以内に、エージェントはフロントラインの人間サポート品質のベンチマークを満たすか、それを上回りました。
  • 効率: Codex を駆動する改善ループにより、10 日以内に人間への引き継ぎが 15 パーセンテージポイント削減されました。

Presence の基盤を現在利用しているその他の企業には、メキシコでの銀行向け音声サポートを検討中の BBVA、日本語の顧客会話をテスト中の SoftBank、および高需要の気象イベント時のサポートを検討中の IAG が含まれます。

デプロイと提供状況

OpenAI Presence はセルフサービス製品ではありません。限定された一般提供プログラムを通じて、該当するエンタープライズ顧客に提供されます。デプロイは、ワークフローの特定、システムの接続、権限の設定において顧客と協力する OpenAI Forward Deployed Engineers(FDE)および選定されたグローバルシステムインテグレーターによって管理されます。

OpenAI は、OpenAI API を介して直接フロンティアモデルにアクセスしたい音声顧客のサポートを継続しています。

Sources