OpenAI 案例研究:中国执法部门的“网络特战”影响力行动
TL;DR
OpenAI 封禁了一个与中国执法部门有关的 ChatGPT 账户,该用户曾试图利用该模型策划针对日本首相的秘密影响力行动,并编辑关于更广泛的“网络特战”行动的状态报告,这揭露了一项针对全球异见人士、资源密集且由人工智能增强的行动。
行动者与即时行动
结论: OpenAI 识别并禁用了与中国执法人员相关的 ChatGPT 账户,这些人员曾寻求模型协助进行秘密影响力策划。
- 该用户试图获取针对日本首相高市早苗(Sanae Takaichi)的行动指导,并要求模型润色定期行动报告。
- ChatGPT 拒绝提供策划建议;用户随后提交了一份报告进行润色,表明该行动在没有模型协助的情况下继续进行。
- OpenAI 的调查将该用户的活动与一项被称为“网络特战”的更广泛的中国背景影响力行动联系起来。
行动策划尝试
结论: 用户的提示词揭示了一个结构化的、多向量的抹黑日本领导人的计划,但模型拒绝协助执行。
- 六步计划:(1) 放大负面评论,(2) 捏造外国居民投诉,(3) 利用生活成本叙事,(4) 指控其与极右翼的联系,(5) 煽动反美关税情绪,(6) 传播关于内蒙古的正面信息。
- 在遭到拒绝后,用户提交了一份状态报告草案,该草案遵循了相同的五个主题支柱(不包括内蒙古元素),并声称了诸如网红外联和标签部署等执行细节。
- 开源验证发现,标签 #右翼共生者 在 2025 年 10 月下旬出现在 X、Pixiv 和 Blogspot 上,参与度较低,与用户的描述相符。
低影响力在线活动的证据
结论: 已识别的帖子显示了该行动的策略,但覆盖范围有限,表明其现实世界的影响力微乎其微。
- 模因和帖子的参与度可以忽略不计(例如,最高的 Pixiv 浏览量 = 108,YouTube 视频 < 5 次观看)。
- 据报道,平台清理在几天内删除了约 200 个虚假账户,进一步限制了可见度。
- 尽管指标较低,但这些活动与用户声称的策略和时间表一致。
跨平台的战术范围
结论: 用户列举了 100 多种不同的战术,展示了一套全面的压制批评者的策略手册。
- 战术包括叙事操纵、内容轰炸、虚假账户放大、虚假举报、骚扰、针对家庭成员、直播劫持和线下恐吓。
- 通过开源数据验证的具体示例:
- Spamouflage 风格的标签活动和模因分发。
- 针对异见人士界立建的虚假讣告,得到了美国之音(VoA)报道和一个名为“界立建治丧委员会”的 X 账户的佐证。
- 针对 X 用户 @huikezhen(辉波)的协同滥用举报,导致了可见的限制通知。
- 在 Bluesky 上的冒充行动,2024 年 12 月 5 日创建了五个模仿辉波的账户。
- 用户的报告还提到了线下恐吓(例如逮捕、向雇主进行虚假指控、海报运动),OpenAI 无法独立核实这些内容。
本地部署 AI 模型的使用
结论: 据报道,该行动利用开源权重的中国 AI 模型进行监控、翻译和内容创作。
- 引用的模型:DeepSeek-R1、Qwen 2.5 和计算机视觉模型 YOLOv8。
- OpenAI 之前的威胁情报报告(2025 年 2 月,2025 年 10 月)记录了类似的中国背景用户使用开源权重模型进行社交媒体监控和网络钓鱼。
- 没有直接证据证实披露行动中使用了特定模型,但该说法与已知模式一致。
规模与人员配置声明
结论: 用户的内部报告表明这是一项大规模的省级行动,拥有数百名操作员和数千个虚假账户。
- 一份报告声称在单个省份有 300 名操作员,其他地方也有类似的团队,暗示了国家级的人员配置水平。
- 报告的活动跨越了 300 多个国内平台(微博、微信)和 300 个国外平台,国内有“数百万条帖子”,国外有“数万条”。
- 用户声称系统性地集成了 AI 用于画像、翻译和文档记录,尽管缺乏独立验证。
影响评估
结论: 虽然一些异见人士经历了骚扰和账户限制,但总体可衡量的在线影响似乎有限。
- 记录的结果包括辉波的账户受限以及某些目标的活动减少。
- 大多数已识别的帖子产生的参与度可以忽略不计;许多标签和模因被迅速删除或未被真实受众看到。
- 用户声称在 200 多个西方平台上发布了超过 50,000 条帖子,但只有约 150 条帖子的互动量超过 300 次,表明转化率较低。
更广泛的影响
结论: 该案例强调了建立强大的模型级滥用检测的必要性,并突显了国家关联行为者如何试图将大语言模型(LLM)武器化以进行秘密影响力行动。
- 即使 LLM 拒绝协助,工作流程中存在模型(例如用于报告润色)也可以提供有助于情报分析的行动文档。
- 本地部署 AI 模型的集成将威胁面扩展到了商业 API 之外,需要对开源权重模型的滥用进行更广泛的监控。
- OpenAI 的公开披露为研究界、平台运营商和政策制定者追踪和反击国家支持的影响力行动提供了宝贵的开源证据。
关键要点: OpenAI 的调查揭示了一个由中国执法部门运营的、复杂的、人工智能增强的“网络特战”计划,该计划结合了在线骚扰、虚假账户放大和线下恐吓,但所记录行动在公开可观察的在线影响仍然有限。