OpenAI Sora 피드 철학

OpenAI는 창의성 중심 순위, 개인화된 추천, 다층 안전 가드레일에 중점을 두어 Sora 피드의 설계 원칙과 안전 프레임워크를 상세히 설명했습니다.

핵심 설계 원칙

  • Creativity-First Ranking: 순위 알고리즘은 창의성과 적극적인 참여를 수동적 소비보다 우선시하여 경험이 즐거움을 유지하도록 합니다.
  • User Control: 피드에는 조정 가능한 순위가 포함되어 있어 사용자가 명시적으로 선호도를 정의할 수 있습니다. 또한, 부모는 ChatGPT 부모 제어를 통해 연속 스크롤을 관리하고 청소년에 대한 피드 개인화를 비활성화할 수 있습니다.
  • Prioritization of Connection: 시스템은 전 세계의 연결되지 않은 콘텐츠보다 연결된 콘텐츠와 "Cameo flows"를 우선시하여 사용자가 사회적 연결을 형성하고 강화하도록 돕습니다.
  • Balanced Safety and Freedom: 피드는 유해한 생성물을 방지하는 강력한 가드레일을 통해 넓은 접근성을 목표로 하면서도 커뮤니티 표현을 위한 공간을 유지합니다.

추천 엔진 및 개인화

Sora는 사용자가 영감을 받아 "riff off"할 수 있는 콘텐츠를 예측하기 위해 개인화된 추천 시스템을 사용합니다. 알고리즘은 피드 콘텐츠를 결정하기 위해 여러 신호 카테고리를 활용합니다:

  • Sora Activity: 여기에는 게시물, 팔로우한 계정, 좋아요 및 댓글이 달린 게시물, 리믹스된 콘텐츠, 그리고 IP 주소에서 파생된 일반 위치(도시 수준)가 포함됩니다.
  • ChatGPT Integration: 시스템은 추천을 개인화하기 위해 ChatGPT 기록을 통합할 수 있지만, 사용자는 Sora의 데이터 제어에서 이 기능을 비활성화할 수 있습니다.
  • Engagement Signals: 알고리즘은 조회수, 좋아요, 댓글, 리믹스 및 명시적인 "see less content like this" 지시를 추적합니다.
  • Author Signals: 팔로워 수, 기타 게시물, 과거 참여 수준과 같은 메트릭이 고려됩니다.
  • Safety Signals: 시스템은 게시물이 적절한지 또는 정책 위반인지 평가합니다.

안전 프레임워크 및 콘텐츠 중재

OpenAI는 유해 콘텐츠가 피드에 들어오는 것을 방지하기 위해 사전 예방, 자동 스캔 및 인간 감독을 결합한 다층 방어 전략을 사용합니다.

생성 시점 가드레일

첫 번째 방어층은 생성 과정 중에 발생합니다. 콘텐츠가 Sora 내에서 생성되기 때문에 OpenAI는 처음부터 안전하지 않거나 유해한 콘텐츠가 생성되는 것을 방지하기 위해 가드레일을 구현합니다. 이러한 초기 가드레일을 우회한 콘텐츠는 공유 기능이 제거될 수 있습니다.

자동 및 인간 검토

모든 피드 콘텐츠는 전 세계 사용 정책 및 피드 적합성 준수를 위해 자동 도구로 스캔됩니다. 이러한 도구는 새로운 위험에 대응하기 위해 지속적으로 업데이트됩니다. 이 자동 레이어는 인간 검토와 보완되며, 팀은 사용자 신고를 모니터링하고 활동을 사전적으로 확인하여 자동 감지를 놓친 위반을 포착합니다.

금지된 콘텐츠

콘텐츠가 전 세계 사용 정책 또는 Sora 배포 가이드라인을 위반하는 경우 피드 및 기타 공유 플랫폼(예: 사용자 갤러리)에서 제거됩니다. 금지된 콘텐츠는 다음을 포함합니다:

  • 그래픽 성적 콘텐츠 및 그래픽 폭력.
  • 극단주의 선전 및 혐오 콘텐츠.
  • 동의 없이 살아있는 개인의 수십억 달러 가치 외모 혹은 사망한 공인 인물의 무단 사용.
  • 자해, 섭식 장애를 조장하거나 미성년자가 모방할 가능성이 있는 위험한 챌린지를 홍보하는 콘텐츠.
  • Engagement Bait: 주로 참여를 위해 제작된 저품질 콘텐츠.
  • 지적 재산권 침해.
  • 괴롭힘 및 외모 기반 비판.

표현과 보호의 균형

OpenAI는 안전 접근 방식이 ChatGPT의 4o 이미지 생성 모델에 사용된 철학을 기반으로 한다고 밝힙니다: 고위험 영역에 대한 사전 가드레일과 반응형 "report + takedown" 시스템을 결합합니다. 이를 통해 사용자는 더 많은 탐색 공간을 얻으며 문제성 콘텐츠에 대한 신속한 대응을 보장합니다.

Sources