OpenAI가 악의적인 AI 사용을 차단하다

OpenAI는 악의적인 AI 도구 사용을 차단하기 위한 시스템을 구현했으며, 권위주의 정권과 국가 연계 위협 행위자가 AI를 사용하여 권력을 축적하거나 다른 국가를 강압하거나 은밀한 영향력 작업을 수행하는 것을 방지하는 데 중점을 두고 있습니다. 이 접근 방식은 상식적인 규칙을 적용하여 실제 피해로부터 사람들을 보호함으로써 인공 일반 지능이 인류에 이익이 되도록 보장하려는 보다 넓은 사명의 일부입니다.

악의적인 AI 사용을 차단하기 위한 기술적 접근

OpenAI의 악의적인 AI 사용을 차단하기 위한 전략은 권위주의 정권이 시민을 통제하거나 다른 국가를 위협하기 위해 AI 도구를 사용하는 것을 방지하는 데 중점을 둡니다. 해당 조직은 적대적인 권위주의 정권의 조치에 맞서 민주적인 AI를 보호하기 위해 AI 기반 조사 역량을 사용하는 것을 강조합니다.

표적 위협 범주

OpenAI는 AI 도구가 촉진할 수 있는 고위험 악성 활동의 몇 가지 주요 영역을 식별합니다. 다음은 그 예시입니다:

  • 은밀한 영향력 작업(IOs): 숨은 출처를 통해 여론을 조작하거나 허위 정보를 퍼뜨리기 위해 AI를 사용하는 것을 방지
  • 악성 사이버 활동: 국가 연계 행위자가 사이버 공격을 수행하는 데 사용할 수 있는 활동을 차단
  • 은밀한 영향력 작업(IOs): 아동 착취, 사기, 스팸을 조장하기 위해 useand AI 도구를 사용하는 것을 방지

협력 및 보고

OpenAI는 악의적인 행위자에 대한 차단 사항을 보고서로 게시하는 관행을 확립했습니다. 이는 처음으로 그러한 일을 한 AI 연구소였으며, 이 최신 보고서는 AI 기반 작업의 동향과 특징을 개괄하고 차단된 위협에 대한 사례 연구를 제공합니다. 이러한 보고서는 적대 세력과 악의적인 행위자에 의한 남용을 방지하기 위해 미국 및 동맹 정부, 산업 파트너, 기타 이해관계자와 공유하는 동일한 목표를 지원하기 위해 마련되었습니다.

Sources