OpenAI, AI를 활용한 국가 연계 위협 행위자들을 차단
OpenAI는 악의적인 사이버 활동을 위해 AI 서비스를 사용하려던 5명의 국가 연계 위협 행위자 계정을 차단했습니다. 이러한 결과는 국가 행위자들이 AI를 활용하려고 시도하고 있지만, 현재 모델은 기존 비AI 기반 도구에 비해 사이버 보안 작업에 대한 제한적이고 점진적인 기능만을 제공한다는 것을 보여줍니다.
국가 연계 행위자 차단
OpenAI와 Microsoft Threat Intelligence는 5명의 특정 국가 연계 행위자를 식별하고 차단했습니다. 영향을 받은 계정은 다음 그룹에서 차단되었습니다:
- 중국: Charcoal Typhoon and Salmon Typhoon
- 이란: Crimson Sandstorm
- 북한: Emerald Sleet
- 러시아: Forest Blizzard
이 행위자들은 주로 오픈소스 정보 조회, 번역, 코드 오류 찾기, 기본 코딩 작업 수행과 같은 기본 작업에 OpenAI 서비스를 활용했습니다.
특정 행위자 활동
각 그룹은 서로 다른 전략적 목표를 위해 AI 도구를 활용했습니다:
- Charcoal Typhoon: 기업 및 사이버 보안 도구 조사, 코드 디버깅, 스크립트 생성, 피싱 캠페인용 콘텐츠 제작에 집중했습니다.
- Salmon Typhoon: 기술 논문 번역, 정보기관 및 지역 위협 행위자에 대한 공개 정보 수집, 코딩 지원, 시스템에서 프로세스를 숨기는 방법 연구에 서비스를 사용했습니다.
- Crimson Sandstorm: 앱 및 웹 개발 스크립팅 지원, 스피어 피싱 콘텐츠 생성, 악성코드 탐지 회피 연구를 위해 플랫폼을 활용했습니다.
- Emerald Sleet: 아시아-태평양 지역의 방위 전문가 및 조직을 식별하고, 공개 취약점을 조사하며, 기본 스크립팅을 수행하고, 피싱 콘텐츠 초안을 작성했습니다.
- Forest Blizzard: 주로 레이더 영상 기술 및 위성 통신 프로토콜에 대한 오픈소스 연구와 스크립팅 지원을 수행했습니다.
사이버 보안 작업에서의 AI 역량
이번 차단 결과는 OpenAI와 외부 전문가들이 수행한 이전 레드팀 평가와 일치합니다. 이러한 평가에 따르면 GPT-4는 공개적으로 이용 가능한 비AI 기반 도구로 이미 달성 가능한 수준을 넘어서는 악의적인 사이버 보안 작업에 대해 제한적이고 점진적인 역량만을 제공한다고 결론지었습니다.
OpenAI의 다각적 안전 전략
국가 연계 악용 위협이 진화함에 대응하기 위해 OpenAI는 네 부분으로 구성된 안전 프레임워크를 적용합니다:
모니터링 및 차단
OpenAI는 전담 인텔리전스·조사, 안전, 보안, 무결성 팀을 활용해 정교한 위협 행위자를 식별합니다. 이 팀들은 OpenAI 자체 모델을 사용해 적의 상호작용을 분석하고 의도를 평가합니다. 감지된 행위자는 계정 비활성화, 서비스 종료 또는 자원 제한을 받게 됩니다.
생태계 협업
OpenAI는 산업 파트너 및 이해관계자와 협력하여 국가 연계 행위자에 의한 AI 사용 감지 정보를 교환합니다. 이 노력은 AI 기술의 안전하고 투명한 개발을 촉진하기 위한 자발적 약속의 일환입니다.
반복적 안전 완화
실제 악용 데이터를 활용해 안전 방어책의 반복적 개발에 반영합니다. 정교한 행위자들이 시스템을 악용하려는 방식을 분석함으로써 OpenAI는 널리 퍼질 수 있는 패턴을 식별하고, 모델 방어책을 지속적으로 진화시킬 수 있습니다.
공개 투명성
OpenAI는 필요에 따라 감지된 악의적인 국가 연계 활동의 성격과 범위에 대해 대중 및 이해관계자에게 알리는 정책을 유지합니다. 목표는 집단 방어를 촉진하고 모든 이해관계자의 인식을 높이는 것입니다.