OpenAI コンテンツプロバナンスのアップデート

OpenAI コンテンツプロバナンス(由来)のアップデート

OpenAIは、ユーザーがAI生成メディアの起源と作成プロセスを検証できるようにするため、コンテンツプロバナンスに対する多層的なアプローチを導入しました。このシステムは、オープンな技術標準、耐久性のあるウォーターマーキング、および公開検証ツールを組み合わせることで、異なるプラットフォームや変換をまたいでプロバナンス信号が維持されるように設計されています。

標準化されたメタデータのためのC2PA準拠

OpenAIは現在、C2PA準拠のGenerator Product(生成製品)となっており、そのツールはCoalition for Content Provenance and Authenticity (C2PA) によって設定された技術標準に従っています。C2PAは、暗号署名とメタデータを使用して、メディアの起源や編集履歴に関する情報をコンテンツに直接、安全に付与します。

この準拠により、他のプラットフォームでもプロバナンス情報を確実に読み取り、保存し、受け渡すことが可能になります。OpenAIは、2024年以降、これらのContent CredentialsをDALL·E 3、ImageGen、およびSoraに統合しています。

Google SynthIDによる多層的なプロバナンス

ファイル形式の変更、リサイズ、またはスクリーンショットによってメタデータが削除されたり失われたりする可能性があるため、OpenAIはChatGPT、Codex、およびOpenAI APIを通じて生成された画像に対して、Google DeepMindのSynthIDを組み込んでいます。

SynthIDは、C2PAメタデータを補完する不可視のウォーターマーキング層を提供します。C2PAが詳細なコンテキストを提供するのに対し、SynthIDは、通常メタデータを破壊してしまうような変換に対しても、より高い耐久性を持つように設計されています。これら2つのシステムが組み合わさることで、それぞれが単独で提供できるものよりも、より回復力のある信号が作成されます。

公開検証ツール

OpenAIは、ユーザーが画像をアップロードして、それがChatGPT、OpenAI API、またはCodexを使用して生成されたものかどうかを判断できる公開検証ツールのプレビュー版を提供しています。このツールは、以下の2つの特定の信号をチェックすることで機能します:

  1. Content Credentials: C2PA準拠のメタデータ。
  2. SynthID: 不可視のウォーターマーク。

メタデータやウォーターマークが検出されない場合、プロバナンス信号が削除されるケースがあるため、ツールは決定的な結論は出しません。現在、このツールはOpenAIによって生成されたコンテンツに限定されていますが、今後数ヶ月以内に他のプラットフォームやコンテンツタイプへのサポートを拡大する予定です。

プロバナンス層の概要

技術 主な機能 強み
Metadata C2PA / Content Credentials 詳細なコンテキストと暗号署名 標準化されており、相互運用が可能
Watermarking Google SynthID 不可視の埋め込み信号 スクリーンショットやリサイズに対して耐久性がある
Verification 公開検証ツール 信号の検出と解釈 ユーザーがアクセス可能な透明性

Sources