行动代号“滚石”(Trolling Stone):与俄罗斯有关的影响力活动
TL;DR
OpenAI 封禁了多个 ChatGPT 账户,这些账户参与了一项代号为“滚石”(Trolling Stone)的协同影响力行动。该行动利用 AI 生成的文章和评论来宣传一位俄罗斯邪教领袖,并攻击阿根廷媒体。
行动者与地理足迹
该行动涉及的账户发布了关于俄罗斯邪教领袖嫌疑人 Konstantin Rudnev 在阿根廷被捕的 AI 生成内容。活动源自巴基斯坦、亚美尼亚、乌拉圭、阿根廷和哈萨克斯坦,其中一个受雇行动者与巴基斯坦有关。该网络既制作支持 Rudnev 的信息,也对阿根廷法律体系和《滚石》阿根廷版(Rolling Stone Argentina)进行抨击。
跨语言的协同行为
- 英语提示词来自巴基斯坦用户,而其他参与者则使用俄语提示词。
- 尽管地理位置分散,但行动者以阿根廷西班牙语制作了前后一致的支持 Rudnev 的叙事,并将其发布在伪装成当地新闻媒体的 Facebook 页面上。
- 该行动生成了简短的新闻风格文章(3-4 段),并发布在新建的 Facebook 页面上(注册于 2025 年 10 月 14-15 日),这些页面的管理员位置显示在乌拉圭、亚美尼亚和巴基斯坦。
“Facebook 页面‘El Horizonte’的简介和页面信息……注意其声称在阿根廷设有编辑地址,而页面管理员位置却在乌拉圭、亚美尼亚和巴基斯坦。” – OpenAI 案例研究
内容生产流水线
- 文章生成 – ChatGPT 被用于撰写一般性的阿根廷新闻稿,并将关于 Rudnev 的俄语文章翻译成阿根廷西班牙语。
- 发布渠道 – 文章出现在虚假的 Facebook 新闻页面上,以及 YouTube、Medium 和一些阿根廷新闻网站上。至少有一个案例显示,发布的内容与 AI 输出完全一致,只是删除了长破折号,这表明其试图掩盖 AI 生成的痕迹。
- 评论虚假民意(Astroturfing) – 独立的 ChatGPT 账户在同一篇文章以及《滚石》阿根廷版的 Facebook 和 Instagram 帖子下生成评论串。评论被发布在多个平台(perfil.com、YouTube、Medium、Instagram)上,以模拟草根参与。
“在阿根廷新闻网站 perfil.com、YouTube 和 Medium 上,针对该行动生成的文章所发表的评论。” – OpenAI 案例研究
针对《滚石》阿根廷版
该行动专门攻击了《滚石》阿根廷版对 Rudnev 的报道。在《滚石》发表了一篇将 Rudnev 贴上“古怪大师”标签的文章后,该网络发布了 AI 生成的评论,指责该杂志新闻报道失实。一些评论链接到了一篇伪造的反驳文章,该文章在发布前一天通过 ChatGPT 进行了编辑。
操作指令与协调
- 一名巴基斯坦用户要求 ChatGPT 协助执行一套指令,要求每个虚假账户每天发布 20 次,并发送每日进度更新。
- 讲俄语的用户要求 ChatGPT 将这些指令翻译成英语,发给巴基斯坦的同事,详细说明了发布数量以及让虚假账户看起来真实的操作策略。
- 额外的提示词生成了针对女性团体的宣传材料,引用了神秘主义和萨满教——这些策略此前曾被报道为 Rudnev 所谓邪教的招募手段。
衡量影响
- 这些 Facebook 页面仅积累了数百名粉丝,帖子通常只有个位数的互动。
- 一些 AI 生成的文章被阿根廷地区新闻媒体转载,尽管 OpenAI 无法核实其提交过程。
- 使用布鲁金斯学会的突破规模(Breakout Scale)(1 为最低,6 为最高),OpenAI 将该行动评估为低端 4 类,表明其向主流媒体的渗透有限。
对 AI 治理的启示
- 该案例展示了现成的语言模型如何轻易地被武器化,用于跨多种语言和平台的协同虚假信息运动。
- 它强调了对稳健的检测、账户级监控和快速响应机制的需求,以减轻 AI 驱动的影响力行动。
- OpenAI 对相关账户采取的主动封禁措施展示了一个实际的缓解步骤,但行动者的跨国性质凸显了司法执行面临的挑战。
本案例研究最初发表于 OpenAI 2026 年 2 月关于打击恶意使用 AI 的报告中。