ChatGPT プラグインのリリース

OpenAI は ChatGPT にプラグインの初期サポートを実装し、言語モデルが最新情報にアクセスし、計算を実行し、サードパーティサービスを利用できるようにしました。この拡張により、ChatGPT はテキスト生成エンジンから、外部データとやり取りし、ユーザーに代わって制約されたアクションを実行できるシステムへと変わります。

コア機能と目的

プラグインは言語モデルの「目と耳」として機能し、静的な学習データの固有の制限を克服します。最新すぎる、個人的、または学習コーパスに対して特定すぎる情報へのアクセスを提供することで、プラグインは ChatGPT に以下を可能にします:

  • リアルタイムデータへのアクセス: インターネットや特定のデータベースから最新情報を取得します。
  • 計算の実行: 正確な数学的・技術的計算を実行します。
  • アクションの実行: サードパーティサービスの統合を利用して、安全で制約されたタスクを実行します。

OpenAI はこれらのツールを段階的に展開しており、まず限られたユーザーと ChatGPT Plus の加入者に提供し、実際の影響と安全性の課題を研究した上で、API ユーザーへのアクセスを拡大します。

ファーストパーティプラグイン: ブラウジングとコードインタープリタ

OpenAI は、モデルの基礎機能を強化するために、2 つの主要な内部プラグインを開始しました:

ウェブブラウジング

ブラウジングプラグインにより、ChatGPT はインターネット上の情報を読み取ることができ、学習コーパスを超えて知識を拡張します。

  • 技術的実装: プラグインは Bing 検索 API を使用し、セキュリティリスクを減らすために GET リクエストのみを行うよう制限されています。OpenAI のメインインフラストラクチャとは別の隔離されたサービス内で動作します。
  • ウェブ市民性: プラグインはユーザーエージェントトークン ChatGPT-User を使用し、robots.txt ファイルを尊重してコンテンツ制作者の権利を守ります。
  • 透明性: システムは情報源を引用し、訪問したウェブサイトの一覧を示すことで、ユーザーが正確性を検証し、制作者にクレジットを提供できるようにします。

コードインタープリタ

コードインタープリタは、サンドボックス化されファイアウォールで保護された実行環境内に、一時的なディスク領域を持つ動作する Python インタープリタを ChatGPT に提供します。

  • 機能性: ファイルのアップロードとダウンロードをサポートし、モデルが定量的・定性的な数学問題を解決し、データ分析や可視化を行い、ファイル形式間の変換を行えるようにします。
  • 安全性: 意図しない副作用を防ぐため、環境は厳格なネットワーク制御で保護され、実行されたコードからの外部インターネットアクセスが無効化されています。

オープンソース取得プラグイン

OpenAI は、許可された個人または組織の情報源にアクセスできる取得プラグインをオープンソース化しました。

  • メカニズム: プラグインは OpenAI 埋め込みを活用し、開発者がベクトルデータベース(Milvus、Pinecone、Qdrant、Redis、Weaviate、または Zilliz など)を選択して文書のインデックス作成と検索を行えるようにします。
  • セキュリティ: このプラグインは自己ホスト型ソリューションで、外部への影響を与えることなく結果を ChatGPT セッションに追加するだけなので、主なセキュリティリスクはデータの認可とプライバシーに集中しています。

サードパーティプラグインエコシステム

サードパーティプラグインは、機能とユーザー向けドキュメントの機械可読な記述を含むマニフェストファイルに基づき、言語モデルから呼び出されるよう設計されています。

開発プロセス

開発者は、API(新規、既存、またはラッパー)を構築し、OpenAPI 仕様とマニフェストファイルを提供することでプラグインを作成します。ユーザーがプラグインを有効にすると、そのドキュメントが会話コンテキストの一部としてモデルに提供され、モデルは API を呼び出すタイミングと方法を判断できるようになります。

初期パートナー

初期の協力者には Expedia、FiscalNote、Instacart、KAYAK、Klarna、Milo、OpenTable、Shopify、Slack、Speak、Wolfram、Zapier が含まれます。

安全性と社会的影響

言語モデルを外部ツールに接続することは、害を及ぼすまたは意図しない行動、洗練されたプロンプトインジェクション、情報の悪用など、重大なリスクをもたらします。

緩和策

OpenAI は、内部および外部のレッドチーム演習に基づく複数の安全策を実装しています:

  • 設計段階での安全性: リスクの高いプラグインの動作を制限し、プラグインが稼働しているタイミングに関する透明性を向上させます。
  • 段階的展開: アクセスを徐々に提供し、潜在的な問題の影響範囲(ブラストラジウス)を制限します。
  • 評価フレームワーク: オープンソースの Evals フレームワークを活用して、安全性と機能評価を行います。

経済的影響

OpenAI は、ツールへのアクセスを持つ言語モデルは持たないモデルよりも経済的影響が大きくなる可能性があるという研究を引用しており、職業の変革、置換、創出を加速させる可能性があります。


OpenAI は ChatGPT 用のプラグインを導入し、モデルがリアルタイム情報にアクセスし、計算を実行し、サードパーティサービスと統合できるようにすることで、ユーティリティを拡大し、幻覚(ハルシネーション)を減らします。

ChatGPT プラグインのリリース

Sources