OpenAI Operation Peer Review:破坏 AI 辅助的监视规划
OpenAI 已禁止了一批被称为“Operation Peer Review”的 ChatGPT 账户,这些账户可能来源于中国,且用于协助监视规划、政治研究以及社交媒体监测工具的开发。此举破坏了一个利用 AI 进行能力开发和内部分析,而非大规模公共影响行动的网络。
网络识别与行为模式
“Peer Review”网络由表现出符合中国大陆工作时间的行为模式并使用中文提示的 ChatGPT 账户组成。OpenAI 指出,活动的数量和多样性更符合手动提示,而非自动化 API 使用。至少有一次,证据显示同一个账户被多个操作者共享。
主要运营工作流
该集群的操作者从事了四大类活动:
政治与政府研究
网络将 ChatGPT 用作基础研究工具,以收集美国智库以及美国、澳大利亚和柬埔寨的政治人物和政府官员的公开信息。
文档分析与翻译
操作者使用模型阅读、翻译并分析英文文档的截图。这些文档包括在多个西方城市举行维吾尔权利抗议的公告——可能来源于社交媒体——以及涉及印太地区外交和政府议题的材料。OpenAI 表示,缺乏足够证据判断这些文档的真实性或获取方式。
内容生成以进行影响
这些行为者生成了关于美国政策、政治以及中国异议组织(特别是法轮功)的短至中等长度评论。有些提示要求模型以名为“Thompson”的英语使用者身份进行回答。然而,OpenAI 未能发现这些生成的评论在网上被发布的证据。
监视工具开发
网络使用 ChatGPT 编辑和调试代码,并为名为“Qianyue Overseas Public Opinion AI Assistant”(千阅境外舆情AI助手)的 AI 驱动社交媒体监听工具生成宣传材料。
根据该工具的描述(OpenAI 无法独立验证),该助手的设计目标包括:
- 获取并分析来自 X、Facebook、YouTube、Instagram、Telegram 和 Reddit 等平台的帖子和评论。
- 识别涉及中国政治和社会议题的社交媒体对话,特别是呼吁参加中国人权示威的内容。
- 将得到的洞察提供给中国当局,包括监控美国、德国和英国抗议活动的情报人员以及驻外使领馆。
技术实现与模型使用
虽然网络使用 ChatGPT 进行开发和完善,但监视工具的实际执行似乎并未使用 OpenAI 模型。网络调试的代码经常引用通过 Ollama 部署的 Meta Llama 3.1 8B 作为分析和生成的驱动。
此外,网络调试了用于恶意软件分析的代码,并引用了其他模型,包括阿里云的 Qwen 以及 DeepSeek 的未指明模型。一名操作者在绩效评估中声称为中国客户生成了钓鱼邮件,但 OpenAI 未发现该邮件活动由 AI 驱动的证据。
影响评估
OpenAI 报告称,大部分活动集中于内部能力开发——如代码调试和图像分析——而非公开传播。虽然部分内容类似社交媒体评论,但 OpenAI 未能找到这些评论在网上发布的证据。OpenAI 指出,评估此行动的全部影响需要与其他利益相关方合作,包括使用该网络所用开源模型的运营者。