OpenAI, AI 악용 차단 2025년 10월 업데이트

OpenAI는 2024년 2월 이후 사용 정책을 위반한 40개 이상의 네트워크를 차단했으며, 위협 행위자들이 새로운 공격 능력을 개발하기보다는 기존 공격 플레이북을 가속화하기 위해 AI를 주로 사용하고 있음을 언급했습니다.

위협 행위자 플레이북에 AI 통합

위협 행위자들은 현재 AI를 기존 공격 방법론에 통합하여 새로운 공격 능력을 창출하기보다는 작업 속도를 높이고 있습니다. OpenAI는 AI가 "기존 플레이북에 추가"되어 악의적인 행위자들이 더 빠르게 움직일 수 있게 만든다고 관찰했습니다.

탐지 및 완화 전략

OpenAI는 계정 집행과 정보 공유를 결합하여 악의적인 활동을 차단합니다. 사용 정책 위반이 감지되면 회사는 다음과 같은 조치를 취합니다:

  • 계정 차단: 위반 활동이 확인된 계정은 차단됩니다.
  • 파트너 협업: 위협 행위자 행동에 대한 인사이트를 적절한 경우 파트너와 공유합니다.
  • 공개 보고: OpenAI는 악용 인식을 높이고 일반 사용자 기반의 보호를 강화하기 위해 위협 인텔리전스 보고서를 발표합니다.

차단된 활동 범위

차단 노력은 다음과 같은 특정 악용 범주를 목표로 합니다:

  • 국가 연계 위협: 권위주의 정권이 AI를 사용해 다른 국가를 강요하거나 자체 인구를 통제하는 것을 방지합니다.
  • 사이버 활동: 악의적인 사이버 작전을 차단합니다.
  • 영향력 작전: 은밀한 영향력 작전을 식별하고 중단합니다.
  • 금융 사기: AI를 이용한 사기를 방지합니다.

OpenAI는 이러한 조치가 인공지능이 모든 인류에게 혜택을 주도록 보장하는 광범위한 사명의 일환이며, 사용자들을 실제 위험으로부터 보호하는 상식적인 규칙에 기반한 민주적인 AI를 구축하는 것이라고 강조합니다.

Sources