Metaの広告プラットフォーム、AI生成の児童性的虐待画像(CSAM)のブロックに失敗

Metaの広告システム、AI生成CSAM広告の掲載を許可

Metaの広告プラットフォームは、AI生成された児童性的虐待画像(CSAM)を含む50件以上の画像および動画広告のブロックに失敗しました。Meta自身の広告ライブラリのデータによると、これらの違反広告はFacebook、Instagram、Messenger、およびThreadsにわたって公開されており、一部は2026年8月の第1週まで活動を継続していました。

この失敗は、Metaが児童の安全に対する公的なコミットメントを掲げているにもかかわらず、AI生成された露骨なコンテンツ、特に子供を対象とした画像の収益化を検出し、防止する能力におけるシステム的な欠陥を浮き彫りにしています。

モデレーションの失敗の規模

Metaは昨年、3,600万件以上の児童性的搾取コンテンツの削除を報告していますが、公式の広告ライブラリにこれらの広告が存在していることは、自動フィルターが回避されていることを示しています。AI生成画像への移行は、既存の違法コンテンツの既知のハッシュ値に依存していた可能性のあるモデレーションシステムにとって、新たな課題を提示しています。

コミュニティの議論では、Metaのプラットフォーム全体におけるモデレーションの怠慢という、より広範なパターンが強調されています:

  • Ineffective Reporting: ユーザーは、明らかに性的または違法なコンテンツをフラグ立てしても、対応が遅れたり、コンテンツが「適切」であるとの回答が返ってきたりすることが多いと報告しています。
  • Financial Incentives: 一部の批判者は、Metaが収益を最大化するために広告に対して寛容なままでいようとする「歪んだインセンティブ」を持っていると主張しており、年間収益の大部分が詐欺や禁止された商品の広告から得られている可能性があるという報告を引用しています。
  • The "Slop" Problem: AI生成の「slop」(低品質で自動化されたコンテンツ)の台頭は、広告の量を増加させ、人間と自動化されたシステムの双方にとって安全基準を維持することをより困難にしています。

スケールにおける技術的および運用上の課題

Metaの規模におけるコンテンツのモデレーションは非常に困難であり、これが議論の中心的な論点となっています。数十億人のユーザーと、毎秒配信される天文学的な数の広告があれば、すべてのコンテンツに対して人間によるモデレーションは機能的に不可能です。

ある分析によれば、アップロードの膨大な量から、モデレーションの有効性が99%であっても、毎年数千件のCSAMが流出してしまう可能性があることが示唆されています。人間によるレビューを通じて100%の精度に到達するためのコストは、数十万人のモデレーターの軍隊を必要とし、会社の総広告収益の大部分を消費する可能性があります。

AIの安全性への広範な影響

この事件は、「nudify」アプリやAIツールが、非同意の性的露骨なディープフェイクを作成するために使用されるという、より大きなトレンドの一部です。これらの広告がMetaのフィルターを通過できることは、これらの画像を生成するために使用されるツールが、それらを阻止するために設計された検知メカニズムよりも速く進化していることを示唆しています。

業界のオブザーバーは、この問題がMetaに留まらず、YouTubeやXといった他のプラットフォームもディープフェイク・サービスへのゲートウェイとして機能していると報告されており、この問題が他のプラットフォームにも及んでいることを指摘しています。これらの広告の継続的な存在は、 more robust advertiser identity verification(より強固固な広告主の本人確認)と、合成された露骨な画像をリアルタイムで識別できる、より洗練されたAI駆動型の検知ツールへの極めて重要なニーズを示唆しています。

Sources

関連