OpenAI 아동 안전 약속: 설계에 의한 안전 원칙 채택

OpenAI는 Amazon, Anthropic, Civitai, Google, Meta, Metaphysic, Microsoft, Mistral AI, Stability AI 등 업계 리더들과 협력하여 설계에 의한 안전 원칙을 채택했습니다. 비영리 단체 Thorn과 조직 All Tech Is Human이 주도하는 이 이니셔티브는 생성 AI가 아동에게 초래할 위험을 사전에 완화하고, AI 기술의 개발, 배포 및 유지 관리 전반에 걸쳐 아동 안전을 최우선으로 보장하는 것을 목표로 합니다.

아동 안전 AI의 사전 개발

OpenAI는 아동 안전 위험을 사전에 해결하는 생성 AI 모델을 구축하고 훈련하겠다고 약속합니다. 이 개발 단계는 세 가지 주요 기술 및 운영 목표에 초점을 맞춥니다:

  • Training Data Integrity: OpenAI는 훈련 데이터셋을 책임감 있게 확보하고, 훈련 데이터에서 아동 성학대 자료(CSAM)와 아동 성착취 자료(CSEM)를 적극적으로 탐지 및 제거하며, 확인된 CSAM은 관련 당국에 보고합니다.
  • Iterative Testing: 개발 과정은 피드백 루프와 반복적인 스트레스 테스트 전략을 통합하여 취약점을 식별합니다.
  • Adversarial Misuse: 회사는 모델의 적대적 악용을 해결하고 방지하도록 특별히 설계된 솔루션을 배포하고 있습니다.

배포 및 유통 보호

생성 AI 모델의 출시 및 배포 과정에서 안전을 보장하기 위해 OpenAI는 다음과 같은 조치를 약속했습니다:

  • Evaluation and Prevention: 모델은 아동 안전을 위해 훈련 및 평가가 완료된 후에만 출시 및 배포되며, 전 과정에 보호 조치가 통합됩니다.
  • Abuse Response: OpenAI는 남용 콘텐츠와 행위에 대응하고 이를 방지하기 위한 노력을 포함하여 피해를 최소화합니다.
  • Developer Ownership: 회사는 개발자가 다음 설계에 의한 안전 원칙을 소유하도록 장려합니다.

지속적인 유지 관리 및 위험 완화

OpenAI는 지속적으로 새로운 아동 안전 위험을 모니터링하고 대응함으로써 플랫폼 안전을 유지합니다. 이 약속의 주요 내용은 다음과 같습니다:

  • Combating AIG-CSAM: OpenAI는 악의적인 행위자가 생성한 AI 기반 아동 성학대 자료(AIG-CSAM)를 플랫폼에서 제거하겠다고 약속합니다.
  • Research Investment: 회사는 CSAM, AIG-CSAM, CSEM을 방지하기 위한 연구 및 향후 기술 솔루션에 투자할 것입니다.
  • Stakeholder Engagement: OpenAI는 실종·착취 아동 국가센터(NCMEC), Tech Coalition, 그리고 회사의 정부 및 산업 이해관계자들과 지속적으로 협력하여 보고 메커니즘과 아동 보호 문제를 강화합니다.

책임 및 보고

이 작업 그룹의 일원으로서 OpenAI와 그 동료들은 매년 진행 상황 업데이트를 공개하여 이러한 안전 원칙 구현에 대한 투명성과 책임성을 유지하기로 합의했습니다.

Sources