OpenAI 子ども安全と CSAM 防止戦略

OpenAI は、子ども性的虐待資料 (CSAM) および子ども性的搾取資料 (CSEM) の作成と配布を防止するための包括的な安全フレームワークを実装しています。この戦略は、展開前のトレーニング保護策、リアルタイム監視、業界パートナーシップを組み合わせ、AI を子ども搾取に利用しようとする試みを阻止します。

厳格な禁止事項と執行ポリシー

OpenAI は、18 歳未満の個人を搾取、危険にさらす、または性的に扱う行為に対して、サービスの利用を明確に禁止しています。これらの禁止は、エンドユーザーと OpenAI の技術を利用して開発する開発者の両方に適用されます。

禁止されている活動

  • CSAM/CSEM: 子ども性的虐待資料の作成または使用、AI 生成かどうかに関わらず。
  • グルーミングとロールプレイ: 未成年者へのグルーミングや未成年者を対象とした性的/暴力的ロールプレイに従事すること。
  • 未成年者の安全: 未成年者に対し、グラフィックな自傷、性的、暴力的コンテンツを露出させること、健康に害を及ぼす食事や運動を推奨すること、体型や外見を恥ずかしめること。
  • 危険な活動: 未成年者に危険なチャレンジを奨励したり、年齢制限のある商品へのアクセスを提供したりすること。

執行措置

  • ユーザーバン: CSAM/CSEM をアップロードまたは生成しようとするユーザーは即座にバンされ、National Center for Missing and Exploited Children (NCMEC) に報告されます。
  • 開発者の責任: 未成年者向けツールを構築する開発者は、性的に露骨または示唆的なコンテンツの作成を防止しなければなりません。OpenAI はユーザーによる CSAM/CSEM 試行を開発者に通知します。継続的な濫用パターンを是正しない場合、開発者はバンされます。
  • 回避監視: OpenAI の調査チームは、バンを回避しようとして新しいアカウントを作成するユーザーを監視します。

技術的保護策と検出方法

OpenAI は、モデルが搾取的な資料を生成または分析できないようにするための多面的な技術アプローチを採用しています。

トレーニングデータの完全性

モデルが CSAM や CSEM を生成できる能力を獲得しないように、OpenAI はトレーニングデータセットからそのような資料を検出し除去します。このプロセスで確認された CSAM は NCMEC に報告されます。

リアルタイム検出とブロック

OpenAI は本番環境での濫用を特定しブロックするために複数の技術を利用しています:

  • ハッシュマッチング: 社内チームまたは Thorn の検証済みライブラリでフラグ付けされた既知の CSAM を特定するために使用されます。
  • コンテンツ分類器: OpenAI は Thorn の CSAM コンテンツ分類器を使用して、製品にアップロードされた潜在的に新規の CSAM を検出します。
  • AI駆動モニタリング: OpenAI の独自モデルが濫用パターンをより迅速に検出するために展開されています。
  • 人的レビュー: 分類器が潜在的濫用をフラグした場合にのみ、社内の専門家がコンテンツをレビューします。

新たな濫用パターンへの対応

OpenAI は、進化する安全対応が必要な特定の濫用パターンを特定し共有しています:

  • 記述的分析: 一部のユーザーは CSAM をアップロードし、その素材の詳細な説明をモデルに求めます。OpenAI はハッシュマッチングと Thorn の分類器を使用してこれらのリクエストをブロックします。
  • 物語統合: ユーザーは CSAM を物語の一部としてアップロードし、未成年者が虐待的状況に置かれる架空の性的ロールプレイやストーリーにモデルを誘導しようとすることがあります。

これらに対抗するため、OpenAI はコンテキスト対応型分類器と濫用監視をプロンプトレベルの検出と組み合わせ、誤用に対する堅牢性を確保しています。

公共政策と産業協力

OpenAI は、テクノロジー企業、法執行機関、支援団体間の深い協力を可能にする公共政策フレームワークを提唱しています。

レッドチーミング・チャレンジ

OpenAI は、米国において CSAM の所持が違法であるため、シミュレートされた資料であっても CSAM を使用した AI モデルの「レッドチーミング」は現在違法であると指摘しています。この制限により、安全対策の徹底的な検証が困難になっています。

立法支援

OpenAI は、ニューヨーク州の Child Sexual Abuse Material Prevention Act など、企業が AI 生成コンテンツの検出、分類、監視、緩和に積極的に取り組むことを法的に保護する立法を支持しています。

Sources