OpenAI Sora 2 시스템 카드

OpenAI는 물리적 정확성, 시각적 사실감, 오디오 동기화를 개선한 최첨단 비디오·오디오 생성 모델인 Sora 2를 출시했습니다. 이 모델은 창의적인 스토리텔링 능력을 확장하고 복잡한 물리 세계 역학을 시뮬레이션하기 위한 연구 단계 역할을 합니다.

Sora 2의 핵심 역량

Sora 2는 원래 Sora 모델에 비해 여러 기술적 진보를 도입했으며, 충실도와 사용자 제어에 중점을 두었습니다. 주요 개선 사항은 다음과 같습니다:

  • 물리적 정확성 및 사실감: 모델이 보다 정확한 물리와 선명한 사실감을 구현하여 실제 세계 역학에 더 잘 기반한 생성물을 제공합니다.
  • 동기화된 오디오: Sora 2는 비디오 콘텐츠와 동기화된 오디오 생성을 통합합니다.
  • 향상된 제어 가능성: 모델이 사용자의 지시를 더 높은 충실도로 따르며, 제작자가 출력에 대해 보다 정밀한 제어를 할 수 있습니다.
  • 확장된 스타일 범위: 모델이 상상력과 창의적 표현을 위한 다양한 시각적 스타일을 지원합니다.

배포 및 이용 가능성

Sora 2는 여러 플랫폼에서 접근성을 염두에 두고 설계되었습니다. 이용 가능 범위는 다음과 같습니다:

  • 웹 접근: sora.com을 통해 이용 가능.
  • 모바일 접근: 독립형 iOS Sora 애플리케이션.
  • API 접근: 향후 출시 예정.

안전 프레임워크 및 위험 완화

OpenAI는 고충실도 비디오·오디오 생성과 관련된 위험, 특히 비동의 이미지·음성 사용 및 오해를 불러일으키는 콘텐츠 생성을 관리하기 위해 반복적인 배포 전략을 사용합니다.

레드 팀 및 반복적 안전성

OpenAI는 내부 레드 팀과 협력하여 새로운 과제를 식별하고 대응 방안을 개발했습니다. 안전 접근 방식은 반복적이며, 상황이 중요한 경우나 위험이 아직 완전히 파악되지 않은 영역을 우선시합니다.

배포 제한

안전한 롤아웃을 보장하기 위해 OpenAI는 다음과 같은 보호 조치를 구현했습니다:

  • 제한된 접근: 초기 접근은 제한된 초대를 통해 제공됩니다.
  • 업로드 제한: 시스템은 사진실감 나는 사람을 포함한 비디오 및 이미지 업로드를 제한합니다.
  • 미성년자 보호: 미성년자가 포함된 모든 콘텐츠에 대해 엄격한 보호 및 검토 기준을 적용합니다.

Sources