OpenAI 사례 연구: 중국 법 집행 기관의 “사이버 특수 작전” 영향력 공작
요약 (TL;DR)
OpenAI는 중국 법 집행 기관과 연계된 ChatGPT 계정이 일본 총리를 겨냥한 은밀한 영향력 공작을 계획하고 더 광범위한 “사이버 특수 작전” 캠페인에 대한 상태 보고서를 수정하는 데 모델을 사용하려 하자 해당 계정을 차단했습니다. 이번 사건은 전 세계 반체제 인사를 표적으로 삼는 자원 집약적이고 AI로 강화된 공작 활동의 실체를 드러냈습니다.
행위자 및 즉각적인 조치
결론: OpenAI는 은밀한 영향력 공작 계획을 위해 모델의 지원을 구하던 중국 법 집행 인력과 관련된 ChatGPT 계정을 식별하고 비활성화했습니다.
- 해당 사용자는 다카이치 사나에 일본 총리를 겨냥한 캠페인에 대한 지침을 얻으려 했으며, 주기적인 작전 보고서를 다듬어 달라고 모델에 요청했습니다.
- ChatGPT는 계획 수립에 대한 조언 제공을 거부했습니다. 이후 사용자가 보고서를 다듬기 위해 제출한 내용을 보면, 해당 작전은 모델의 도움 없이 진행되었음을 알 수 있습니다.
- OpenAI의 조사 결과, 해당 사용자의 활동은 “사이버 특수 작전”(网络特战)으로 알려진 더 광범위한 중국발 영향력 공작과 연계되어 있음이 밝혀졌습니다.
작전 계획 시도
결론: 사용자의 프롬프트는 일본 지도자의 신뢰를 떨어뜨리기 위한 구조화된 다중 벡터 계획을 드러내고 있으나, 모델은 실행 지원을 거부했습니다.
- 6단계 계획: (1) 부정적인 댓글 증폭, (2) 외국인 거주자의 불만 조작, (3) 생활비 관련 서사 악용, (4) 극우 세력과의 연계 의혹 제기, (5) 반미 관세 정서 조장, (6) 내몽골에 대한 긍정적인 메시지 확산.
- 거부 이후, 사용자는 동일한 5가지 주제 기둥(내몽골 요소 제외)을 따르는 상태 보고서 초안을 제출했으며, 인플루언서 접촉 및 해시태그 배포와 같은 실행 세부 사항을 명시했습니다.
- 오픈소스 검증 결과, 2025년 10월 말부터 X, Pixiv, Blogspot의 낮은 참여도 게시물에서 #右翼共生者 해시태그가 발견되었으며, 이는 사용자의 설명과 일치합니다.
온라인 활동의 낮은 영향력에 대한 증거
결론: 식별된 게시물들은 작전의 전술을 보여주지만 도달 범위가 제한적이어서 실제 영향력은 미미했음을 시사합니다.
- 밈과 게시물은 거의 관심을 끌지 못했습니다(예: Pixiv 최고 조회수 108회, YouTube 영상 5회 미만).
- 플랫폼 차단 조치로 며칠 내에 약 200개의 가짜 계정이 삭제되어 가시성이 더욱 제한되었습니다.
- 낮은 지표에도 불구하고, 해당 활동은 사용자가 주장한 전술 및 일정과 일치합니다.
플랫폼 전반의 전술적 범위
결론: 사용자는 100가지 이상의 다양한 전술을 열거하며 비판자를 억압하기 위한 포괄적인 플레이북을 보여주었습니다.
- 전술에는 서사 조작, 콘텐츠 도배, 가짜 계정 증폭, 허위 신고, 괴롭힘, 가족 표적화, 라이브 스트리밍 하이재킹, 오프라인 협박 등이 포함됩니다.
- 오픈소스 데이터를 통해 검증된 구체적인 사례:
- Spamouflage 스타일의 해시태그 캠페인 및 밈 배포.
- 반체제 인사 Jie Lijian에 대한 가짜 부고, 이는 VoA 보고서 및 “Jie Lijian Funeral Committee”라는 제목의 X 계정을 통해 확인됨.
- X 사용자 @huikezhen (Hui Bo)에 대한 조직적인 악성 신고로 인해 가시적인 제한 조치가 내려짐.
- 2024년 12월 5일에 생성된 Hui Bo를 사칭하는 5개의 Bluesky 계정을 통한 사칭 캠페인.
- 사용자의 보고서는 오프라인 협박(예: 체포, 고용주에 대한 허위 고발, 포스터 캠페인)도 언급했으나, OpenAI는 이를 독립적으로 검증할 수 없습니다.
로컬 배포 AI 모델의 사용
결론: 해당 작전은 모니터링, 번역 및 콘텐츠 생성을 위해 오픈 웨이트 중국 AI 모델을 활용한 것으로 보고되었습니다.
- 인용된 모델: DeepSeek-R1, Qwen 2.5, 컴퓨터 비전 모델 YOLOv8.
- OpenAI의 이전 위협 인텔리전스 보고서(2025년 2월, 2025년 10월)는 소셜 미디어 모니터링 및 피싱을 위해 오픈 웨이트 모델을 사용하는 유사한 중국발 사용자들을 기록한 바 있습니다.
- 공개된 작전에서 특정 모델이 사용되었다는 직접적인 증거는 없지만, 해당 주장은 알려진 패턴과 일치합니다.
규모 및 인력 주장
결론: 사용자의 내부 보고서는 수백 명의 운영자와 수천 개의 가짜 계정을 보유한 대규모 성(省) 단위 작전을 시사합니다.
- 한 보고서는 단일 성에서 300명의 운영자가 활동하고 있으며 다른 곳에도 유사한 팀이 있다고 주장하여 국가적 규모의 인력 수준임을 암시했습니다.
- 보고된 활동은 300개 이상의 국내 플랫폼(Weibo, WeChat)과 300개의 해외 플랫폼에 걸쳐 있으며, 국내에서는 “수백만 개의 게시물”, 해외에서는 “수만 개”의 게시물이 작성되었습니다.
- 사용자는 프로파일링, 번역 및 문서화를 위한 체계적인 AI 통합을 주장했으나, 독립적인 검증은 부족합니다.
영향 평가
결론: 일부 반체제 인사가 괴롭힘과 계정 제한을 경험했지만, 전반적으로 측정 가능한 온라인 영향력은 제한적인 것으로 보입니다.
- 문서화된 결과에는 Hui Bo에 대한 계정 제한 및 특정 표적의 활동 감소가 포함됩니다.
- 식별된 대부분의 게시물은 무시할 만한 참여를 이끌어냈으며, 많은 해시태그와 밈은 빠르게 삭제되거나 실제 사용자들에게 노출되지 않았습니다.
- 사용자는 200개 이상의 서구 플랫폼에서 50,000개 이상의 게시물을 올렸다고 주장했으나, 300회 이상의 상호작용을 달성한 게시물은 약 150개에 불과하여 전환율이 낮음을 보여줍니다.
더 넓은 의미
결론: 이번 사례는 강력한 모델 수준의 오남용 탐지의 필요성을 강조하며, 국가 연계 행위자들이 은밀한 영향력을 위해 LLM을 무기화하려는 시도를 어떻게 할 수 있는지 보여줍니다.
- LLM이 지원을 거부하더라도 워크플로우에 모델이 존재하면(예: 보고서 다듬기) 정보 분석에 도움이 되는 작전 문서를 제공할 수 있습니다.
- 로컬에 배포된 AI 모델의 통합은 상업용 API를 넘어 위협 범위를 확장하므로, 오픈 웨이트 모델 오남용에 대한 더 광범위한 모니터링이 필요합니다.
- OpenAI의 공개는 연구 커뮤니티, 플랫폼 운영자 및 정책 입안자들이 국가 지원 영향력 공작을 추적하고 대응할 수 있도록 귀중한 오픈소스 증거를 제공합니다.
핵심 요약: OpenAI의 조사는 중국 법 집행 기관이 운영하는 정교하고 AI로 강화된 “사이버 특수 작전” 프로그램을 밝혀냈습니다. 이 프로그램은 온라인 괴롭힘, 가짜 계정 증폭, 오프라인 협박을 결합하고 있으나, 문서화된 캠페인의 공개적으로 관찰 가능한 온라인 영향력은 여전히 미미한 수준입니다.