Meta 廣告平台未能攔截 AI 生成的兒童性虐待影像
Meta 廣告系統允許 AI 生成的 CSAM 廣告出現
Meta 的廣告平台未能攔截超過 50 則包含 AI 生成兒童性虐待影像 (CSAM) 的圖片與影片廣告。根據 Meta 自身廣告庫的數據,這些違規廣告發布於 Facebook、Instagram、Messenger 和 Threads,其中部分廣告直到 2026 年 8 月的第一週仍保持活躍狀態。
儘管該公司公開承諾維護兒童安全,但這次失敗凸顯了 Meta 在偵測與防止 AI 生成露骨內容(特別是針對兒童的影像)獲利化方面的系統性漏洞。
審核失敗的規模
雖然 Meta 在過去一年中報告已移除超過 3,600 萬件兒童性剝削內容,但這些廣告出現在官方廣告庫中,顯示自動化過濾器正被繞過。向 AI 生成影像的轉型為審核系統帶來了新的挑戰,因為這些系統先前可能依賴於現有非法內容的已知雜湊值 (hashes)。
社群討論凸顯了 Meta 各個平台中審核疏忽的更廣泛模式:
- 檢舉無效: 用戶檢舉明顯的性或非法內容時,往往會導致行動延遲,或收到稱該內容「合適」的答覆。
- 財務激勵: 一些批評者認為,Meta 為了極大化收入而對廣告保持寬容,存在一種「扭曲的激勵機制」,並引用報告指出,年度收入的很大一部分可能來自詐騙與違禁品廣告。
- 「Slop」問題: AI 生成的「slop」(低品質、自動化內容)的興起,增加了廣告數量,使得人類與自動化系統都更難以維持安全標準。
大規模運作的技術與營運挑戰
在 Meta 的規模下進行內容審核的難度是辯論的核心點。隨著數十億用戶與每秒投放的驚人廣告量,對每一件內容進行人工審核在功能上是不可能的。
一項分析指出,考慮到龐大的上傳量,即使審核有效率達到 99%,每年仍可能讓數千件 CSAM 滲透出來。透過人工審核達到 100% 準確度的成本,將需要一支由數十萬名審核員組成的軍隊,這可能會消耗公司總廣告收入的很大一部分。
對 AI 安全的更廣泛影響
此事件是「nudify」應用程式與 AI 工具被用於創建非自願性露骨深偽 (deepfakes) 的大趨勢的一部分。這些廣告能夠通過 Meta 的過濾器,顯示出用於生成這些影像的工具演進速度快於旨在阻止它們的偵測機制。
業界觀察家指出,此問題不僅限於 Meta,YouTube 與 X 等其他平台據報也充當了深偽服務的門戶。這些廣告的持續存在顯示,迫切需要更強大的廣告主身份驗證,以及更先進的 AI 驅動偵測工具,以能夠即時識別合成的露骨影像。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch