Meta 广告平台未能拦截 AI 生成的儿童性虐待图像

Meta 广告系统允许 AI 生成的 CSAM 广告投放

Meta 的广告平台未能拦截超过 50 条包含 AI 生成的儿童性虐待图像 (CSAM) 的图像和视频广告。根据 Meta 自身广告库的数据,这些违规广告发布在 Facebook、Instagram、Messenger 和 Threads 上,其中一些直到 2026 年 8 月的第一周仍处于活跃状态。

这一失败凸显了 Meta 在检测和防止 AI 生成的显性内容(特别是针对儿童的图像)变现能力方面的系统性漏洞,尽管该公司公开承诺维护儿童安全。

审核失败的规模

虽然 Meta 在过去一年中报告已删除超过 3600 万件儿童性剥削内容,但这些广告出现在官方广告库中表明,自动化过滤器正在被绕过。向 AI 生成图像的转变对审核系统提出了新的挑战,因为这些系统此前可能依赖于现有非法内容的已知哈希值 (hashes)。

社区讨论强调了 Meta 各个平台中普遍存在的审核疏忽模式:

  • 举报机制无效: 用户报告称,标记明显的性或非法内容往往导致行动延迟,或者收到称该内容“合适”的回复。
  • 经济激励: 一些批评者认为,Meta 为了实现收入最大化,在广告投放方面保持宽松具有“扭曲的激励机制”,并引用报告称,很大一部分年收入可能来自诈骗和违禁品广告。
  • “Slop”问题: AI 生成的“slop”(低质量、自动化的内容)的兴起增加了广告量,使得人类和自动化系统都更难维持安全标准。

大规模审核的技术与运营挑战

在 Meta 的规模下进行内容审核的难度是一个辩论的核心点。由于拥有数十亿用户且每秒投放的广告数量惊人,对每一件内容进行人工审核在功能上是不可能的。

一项分析表明,即使审核有效率达到 99%,考虑到上传量的巨大规模,每年仍可能让数千件 CSAM 泄露出来。通过人工审核达到 100% 准确率的成本将需要一支由数十万名审核员组成的军队,这可能会消耗公司总广告收入的很大一部分。

对 AI 安全的更广泛影响

这一事件是“nudify”应用和 AI 工具被用于创建非自愿性显性深度伪造 (deepfakes) 的大趋势的一部分。这些广告能够通过 Meta 的过滤器,表明用于生成此类图像的工具进化速度比旨在阻止它们的检测机制更快。

行业观察人士指出,这一问题不仅限于 Meta,YouTube 和 X 等其他平台也被报道为深度伪造服务的入口。这些广告的持续存在表明,迫切需要更强大的广告主身份验证机制,以及更先进的、能够实时识别合成显性图像的 AI 驱动检测工具。

Sources

相关