OpenAI 모델 사양 업데이트: 18세 미만 (U18) 원칙

OpenAI는 모델 사양—AI 모델 행동을 안내하는 규칙 및 행동 기대치 집합—에 18세 미만 (U18) 원칙을 포함하도록 업데이트했습니다. 이 원칙은 예방, 투명성 및 발달 과학에 기반한 조기 개입을 우선시함으로써 13세에서 17세 사용자를 위한 안전하고 연령에 맞는 경험을 ChatGPT가 제공하도록 보장합니다.

U18 원칙의 핵심 약속

U18 원칙은 미성년자에 대한 안전 고려가 더욱 강조되는 청소년 상황에 모델 사양이 어떻게 적용되는지를 명확히 합니다. 이 프레임워크는 네 가지 핵심 약속을 기반으로 합니다:

  • 청소년 안전 우선: 안전이 다른 모델 목표와 충돌하더라도 최우선으로 합니다.
  • 현실 세계 지원 촉진: 모델은 오프라인 관계와 신뢰할 수 있는 자원의 사용을 장려하도록 설계되었습니다.
  • 연령에 맞는 상호작용: 모델은 청소년을 청소년으로 대우하며, 얕보거나 성인처럼 대하는 것을 피합니다.
  • 투명성: 시스템은 사용자에게 명확한 기대치를 설정합니다.

안전 가드레일 및 고위험 영역

청소년 안전 청사진에 따라, OpenAI는 고위험 주제에 대해 논의할 때 모델이 추가적인 주의를 기울이도록 보호 장치를 구현했습니다. 이러한 보호는 가입 시 18세 미만으로 식별된 사용자에게 적용되며, 부모 통제를 통해 관리됩니다.

특정 고위험 영역은 다음과 같습니다:

  • 자해 및 자살
  • 연애 또는 성적 역할극
  • 그래픽 또는 노골적인 콘텐츠
  • 위험한 활동 및 물질
  • 신체 이미지 및 섭식 장애
  • 불안전한 행동에 대한 비밀 유지 요청

안전 문제가 발생하면, 청소년은 더 강력한 가드레일, 더 안전한 대안, 그리고 오프라인 지원을 찾도록 권장받습니다. 임박한 위험 상황에서는 모델이 사용자가 응급 서비스나 위기 자원에 연락하도록 촉구합니다.

전문가 협업 및 임상 지침

OpenAI는 미국 심리학회(APA)를 포함한 외부 전문가와 사전 검토를 통해 이 원칙을 개발했습니다. APA의 CEO인 Arthur C. Evans Jr 박사는 AI 도구는 사회 및 심리적 발달에 중요한 인간 상호작용과 균형을 이루어야 한다고 강조했습니다:

"APA는 AI 개발자들이 자사 제품의 청소년 사용자에게 발달에 적합한 예방 조치를 제공하고, 더 어린 사용자에게는 보다 보호적인 접근 방식을 취하도록 권장합니다. 과학이 사회적, 심리적, 행동적, 그리고 심지어 생물학적 발달에 중요하다고 보여주는 인간 상호작용과 균형을 이룬다면, 어린이와 청소년은 AI 도구의 혜택을 받을 수 있습니다."

추가 지침은 모든 연령대의 건강한 AI 상호작용을 조언하는 웰빙 및 AI 전문가 위원회와, 모델이 고통을 더 잘 인식하고 사용자를 전문적인 치료로 안내하도록 돕는 글로벌 의사 네트워크에서 제공합니다.

제품 통합 및 향후 로드맵

청소년 보호는 그룹 채팅, ChatGPT Atlas 브라우저, Sora 앱 등 여러 제품에 확대되었습니다. 이러한 보호를 더욱 자동화하기 위해 OpenAI는 ChatGPT 소비자 플랜에 연령 예측 모델을 도입하고 있습니다. 이 모델은 계정이 미성년자일 것으로 판단될 경우 자동으로 청소년 보호 조치를 적용하며, 연령을 확신 있게 확인할 수 없을 경우 시스템은 U18 경험을 기본으로 합니다.

이러한 안전 조치는 GPT-5.2에서 구축된 기반 위에 구축되었으며, ThroughLine과의 파트너십을 통해 ChatGPT와 Sora 내에 현지화된 헬프라인을 제공합니다.

Sources