Meta 광고 플랫폼, AI 생성 아동 성적 학대 이미지 차단 실패

Meta 광고 시스템, AI 생성 CSAM 광고 허용

Meta의 광고 플랫폼이 AI로 생성된 아동 성적 학대 이미지(CSAM)를 포함한 50개 이상의 이미지 및 비디오 광고를 차단하는 데 실패했습니다. Meta 자체 광고 라이브러리 데이터에 따르면, 이러한 위반 광고들은 Facebook, Instagram, Messenger, Threads에 걸쳐 게시되었으며, 일부는 최근 2026년 8월 첫째 주까지도 활성 상태로 남아 있었습니다.

이러한 실패는 아동 안전에 대한 회사의 공개적인 약속에도 불구하고, AI로 생성된 노골적인 콘텐츠, 특히 아동을 대상으로 하는 이미지를 탐지하고 수익화하는 것을 방지하는 Meta의 능력에 체계적인 격차가 있음을 강조합니다.

모더레이션 실패의 규모

Meta가 지난 한 해 동안 3,600만 개 이상의 아동 성적 착취 콘텐츠를 삭제했다고 보고했지만, 공식 광고 라이브러리에 이러한 광고들이 존재한다는 것은 자동화된 필터가 우회되고 있음을 나타냅니다. AI 생성 이미지로의 전환은 기존의 불법 콘텐츠의 알려진 해시값을 기반으로 의존해 왔을 수 있는 모더레이션 시스템에 새로운 과제를 제시합니다.

커뮤니티 논의는 Meta 플랫폼 전반에 걸친 광범위한 모더레이션 태만 패턴을 강조합니다:

  • 비효율적인 신고: 사용자들은 노골적으로 성적이거나 불법적인 콘텐츠를 신고해도 조치가 지연되거나 콘텐츠가 "appropriate"라고 주장하는 응답을 받는 경우가 많다고 보고합니다.
  • 금전적 인센티브: 일부 비평가들은 연간 수익의 상당 부분이 사기 및 금지된 상품 광고에서 발생할 수 있다는 보고를 인용하며, Meta가 수익을 극대화하기 위해 광고에 대해 관대한 태도를 유지하려는 "perverse incentive"가 있다고 주장합니다.
  • "Slop" 문제: AI 생성 "slop"—저품질의 자동화된 콘텐츠—의 부상은 광고의 양을 증가시켜, 인간과 자동화된 시스템 모두가 안전 기준을 유지하는 것을 어렵게 만들고 있습니다.

규모에 따른 기술적 및 운영적 과제

Meta 규모에서의 콘텐츠 모더레이션의 어려움은 논쟁의 핵심입니다. 수십억 명의 사용자와 초당 엄청난 수의 광고가 제공되는 상황에서, 모든 콘텐츠에 대해 인간 모더레이션은 기능적으로 불가능합니다.

한 분석에 따르면, 업로드되는 방대한 양을 고려할 때 모더레이션의 효율성이 99%라 하더라도 매년 수천 개의 CSAM이 유출될 수 있습니다. 인간 검토를 통해 100% 정확도에 도달하는 비용은 수십만 명의 모더레이터 군단을 필요로 할 것이며, 이는 잠재적으로 회사의 총 광고 수익의 상당 부분을 소비할 것입니다.

AI 안전에 대한 광범위한 심층적 함의

이 사건은 비동의 성적 딥페이크를 생성하기 위해 "nudify" 앱과 AI 도구가 사용되는 더 큰 트렌드의 일부입니다. 이러한 광고들이 Meta의 필터를 통과하는 능력은 이러한 이미지를 생성하는 데 사용되는 도구들이 이를 차단하기 위해 설계된 탐지 메커니즘보다 더 빠르게 진화하고 있음을 시사합니다.

업계 관찰자들은 이 문제가 Meta를 넘어 YouTube와 X와 같은 다른 플랫폼들도 딥페이크 서비스로 가는 관문 역할을 하고 있다고 보고되어 이 문제의 범위를 확장시킨다고 언급합니다. 이러한 광고들의 지속성은 더 더욱 강력한 광고주 신원 확인과 실시간으로 합성된 노골적인 이미지를 식별할 수 있는 더욱 정교한 AI 기반 탐지 도구를 필요로 한다는 임계한 필요성을 시사합니다.

Sources

관련