行動代號「滾石行動」(Trolling Stone):與俄羅斯相關的影響力活動

TL;DR

OpenAI 刪除了多個 ChatGPT 帳號,這些帳號參與了一項與俄羅斯相關的協調影響力行動,代號為「滾石行動」(Trolling Stone)。該行動利用 AI 生成的文章和評論來宣傳一位俄羅斯邪教領袖,並攻擊阿根廷媒體。

行動者與地理足跡

該行動涉及的帳號發布了關於俄羅斯邪教領袖 Konstantin Rudnev 在阿根廷被捕的 AI 生成內容。活動源自巴基斯坦、亞美尼亞、烏拉圭、阿根廷和哈薩克,其中一名受僱的行動者與巴基斯坦有關。該網絡製作了支持 Rudnev 的訊息,並批評阿根廷法律體系和《滾石雜誌》阿根廷版 (Rolling Stone Argentina)。

跨語言的協調行為

  • 英文提示詞來自巴基斯坦的用戶,而其他參與者則使用俄文提示詞
  • 儘管地理位置分散,行動者仍以阿根廷西班牙語製作了一致的支持 Rudnev 的敘事,並將其發布在偽裝成當地新聞媒體的 Facebook 頁面上。
  • 該行動生成了簡短的新聞風格文章(3-4 段),並發布在新建的 Facebook 頁面上(註冊於 2025 年 10 月 14-15 日),管理員位置顯示在烏拉圭、亞美尼亞和巴基斯坦。

「Facebook 頁面『El Horizonte』的簡介與頁面資訊……請注意其聲稱的阿根廷編輯地址,以及位於烏拉圭、亞美尼亞和巴基斯坦的頁面管理員位置。」 – OpenAI 案例研究

內容製作流程

  1. 文章生成 – 使用 ChatGPT 撰寫一般阿根廷新聞,並將關於 Rudnev 的俄文文章翻譯成阿根廷西班牙語。
  2. 發布管道 – 文章出現在偽造的 Facebook 新聞頁面上,以及 YouTube、Medium 和一些阿根廷新聞網站上。至少有一個案例中,發布的文本與 AI 輸出完全一致,僅移除了破折號,顯示出隱藏 AI 來源的企圖。
  3. 評論造勢 (Astroturfing) – 獨立的 ChatGPT 帳號在同一篇文章以及《滾石雜誌》阿根廷版的 Facebook 和 Instagram 貼文下生成評論串。評論被發布在多個平台上 (perfil.com, YouTube, Medium, Instagram) 以模擬基層參與。

「在阿根廷新聞網站 perfil.com、YouTube 和 Medium 上,針對該行動生成的文章所發布的評論。」 – OpenAI 案例研究

針對《滾石雜誌》阿根廷版

該行動專門攻擊《滾石雜誌》阿根廷版對 Rudnev 的報導。在《滾石雜誌》發表一篇將 Rudnev 標籤為「古怪大師」的文章後,該網絡發布了 AI 生成的評論,指責該雜誌新聞報導失敗。部分評論連結到一篇捏造的反駁文章,該文章在發布前一天已使用 ChatGPT 編輯過。

操作指令與協調

  • 一名巴基斯坦用戶要求 ChatGPT 協助執行一套指令,要求每個偽造帳號每天發布 20 次,並發送每日進度更新。
  • 俄語用戶要求 ChatGPT 將這些指令翻譯成英文,發送給巴基斯坦的同事,詳細說明發布量以及讓偽造帳號看起來真實的策略。
  • 額外的提示詞生成了針對女性團體的宣傳材料,引用了神秘主義和薩滿教——這些策略先前曾被報導為 Rudnev 涉嫌邪教的招募手段。

影響評估

  • 這些 Facebook 頁面僅累積了幾百名追蹤者,貼文通常只有個位數的互動。
  • 部分 AI 生成的文章被阿根廷地區新聞媒體轉載,但 OpenAI 無法驗證其提交過程。
  • 使用布魯金斯學會的 Breakout Scale(1 為最低,6 為最高),OpenAI 將此行動評估為 低階第 4 類,顯示其對主流媒體的滲透有限。

對 AI 治理的啟示

  • 此案例展示了現成的語言模型如何輕易地被武器化,用於跨多種語言和平台的協調虛假訊息活動。
  • 它強調了對強大的檢測、帳號層級監控和快速反應機制的迫切需求,以減輕 AI 驅動的影響力行動。
  • OpenAI 主動封禁相關帳號展示了實際的緩解步驟,但行動者的跨境性質凸顯了司法管轄執法的挑戰。

本案例研究最初發表於 OpenAI 2026 年 2 月關於破壞惡意使用 AI 的報告中。

Sources