OpenAI Sora フィード哲学

OpenAI は、受動的な消費ではなく創造性と積極的な参加を促すことを目的とした発見システムである Sora フィードの設計哲学を概説しました。このシステムは、ユーザーコントロール、クロスプラットフォームの活動に基づくパーソナライズされた推奨、そして表現と保護のバランスを取る多層的な安全アプローチを強調しています。

コア設計原則

Sora フィードは、ユーザーを受動的なスクロールから能動的な創作へと導くための4つの主要原則に基づいて構築されています。

  • Creativity-First Ranking: ランキングアルゴリズムは、受動的な消費よりも創造性と積極的な参加を優先し、体験が楽しいものになるようにします。
  • User Control: フィードには操作可能なランキングが含まれ、ユーザーは自分の好みを明示的に定義できます。さらに、保護者は ChatGPT のペアレンタルコントロールを通じて連続スクロールを管理し、ティーンエイジャー向けのフィードパーソナライズを無効にできます。
  • Prioritization of Connection: システムは、グローバルで非接続のコンテンツよりも、つながりのあるコンテンツや「Cameo flows」を優先し、ユーザーが社会的つながりを形成・強化できるようにします。
  • Balanced Safety and Freedom: フィードは、有害な生成を防止する堅牢なガードレールを備えつつ、コミュニティの表現の場を維持することで、広範なアクセシビリティを目指します。

推薦エンジンとパーソナライズ

Sora は、ユーザーが「インスピレーションを得て riff off できる」コンテンツを予測するパーソナライズされた推薦システムを使用しています。アルゴリズムは、フィードコンテンツを決定するために複数のシグナルカテゴリを利用します。

  • Sora Activity: これには投稿、フォローしているアカウント、いいねやコメントした投稿、リミックスされたコンテンツ、そして IP アドレスから取得した一般的な位置情報(都市レベル)が含まれます。
  • ChatGPT Integration: システムは推薦をパーソナライズするために ChatGPT の履歴を組み込むことがありますが、ユーザーは Sora のデータコントロールでこの機能を無効にできます。
  • Engagement Signals: アルゴリズムは閲覧数、いいね、コメント、リミックス、そして「このようなコンテンツを少なく表示」指示といった明示的なシグナルを追跡します。
  • Author Signals: フォロワー数、他の投稿、過去のエンゲージメントレベルなどの指標が考慮されます。
  • Safety Signals: システムは、投稿が適切かポリシー違反かを評価します。

安全フレームワークとコンテンツモデレーション

OpenAI は、有害なコンテンツがフィードに入るのを防ぐために、事前防止、 自動スキャン、 人的監視を組み合わせた多層防御戦略を採用しています。

作成時のガードレール

防御の最初の層は生成プロセス中に発生します。コンテンツは Sora 内で生成されるため、OpenAI は安全でない、または有害なコンテンツが最初から作成されるのを防ぐガードレールを実装しています。これらの初期ガードレールを回避したコンテンツは、共有機能が削除される可能性があります。

自動および人的レビュー

すべてのフィードコンテンツは、グローバル利用ポリシーとフィード適格性への準拠を確認するために自動ツールでスキャンされます。これらのツールは新たなリスクに対応するために継続的に更新されます。この自動層は人的レビューで補完され、チームはユーザー報告を監視し、積極的に活動をチェックして自動検出が見逃した違反を捕捉します。

禁止コンテンツ

コンテンツがグローバル利用ポリシーまたは Sora 配布ガイドラインに違反している場合、フィードや他の共有プラットフォーム(ユーザーギャラリーなど)から削除されます。禁止コンテンツには以下が含まれます。

  • 露骨な性的コンテンツおよび露骨な暴力。
  • 過激派プロパガンダおよびヘイトコンテンツ。
  • 同意なしに生存する個人の何十億ドル規模の肖像、または許可されていない文脈での故人の公人の肖像。
  • 自傷行為、摂食障害、または未成年が模倣しやすい危険なチャレンジを助長するコンテンツ。
  • Engagement Bait: 主にエンゲージメント目的で作成された低品質コンテンツ。
  • 知的財産権侵害。
  • いじめや外見に基づく批判。

表現と保護のバランス

OpenAI は、安全アプローチが ChatGPT の 4o 画像生成モデルで使用された哲学に基づいていると述べています。高リスク領域に対する事前ガードレールと、リアクティブな「報告+削除」システムを組み合わせることで、ユーザーに探索の余地を提供しつつ、問題のあるコンテンツへの迅速な対応を確保します。

Sources