OpenAI Sora 2 安全框架
OpenAI 為 Sora 2 及 Sora 應用程式實施了完整的安全框架,以管理高保真影片與音訊生成相關的風險。此框架結合來源訊號、基於同意的相似度控制與分層內容過濾,以防止濫用並保護使用者身分。
AI 內容來源與辨識
Sora 2 確保 AI 生成的內容可透過可見與不可見的訊號被辨識。每部生成的影片皆包含 C2PA 中繼資料、業界標準簽章,以及不可見的來源訊號。OpenAI 維護內部的逆向影像與音訊搜尋工具,以高度精準地將影片追溯至 Sora 平台。
此外,許多輸出會呈現動態移動的浮水印,內含創作者姓名,提供內容來源的可見指示。
相似度與同意管理
OpenAI 引入了特定機制,以處理生成影片中真實人物的相似度,並依創作方式進行分類:
以真實人物的影像轉影片
使用者可上傳家人與朋友的照片以製作影片,前提是他們聲明已取得必要的同意與權利。此類生成受到嚴格的安全防護,限制程度甚至比 Sora 角色更為嚴苛。涉及兒童或看似年輕者的內容亦受相同保護,但審核更為嚴格。
透過角色的同意式相似度
「角色」功能讓使用者自行控制外觀與聲音的相似度。主要保護包括:
- 存取控制:僅使用者自行決定誰能使用其角色,且可隨時撤銷存取權限。
- 公眾人物限制:除非公眾人物本身使用「角色」功能,否則其描繪將被阻止。
- 可見性:使用者可查看所有包含其角色的影片,包括他人創建的草稿,便於審查與刪除。
- 可自訂防護欄:使用者可啟用嚴格的防護設定,以防止外觀重大變更、避免尷尬情境,並維持身分一致性。
青少年使用者保護
Sora 為年輕使用者提供專門的保護措施,以確保符合年齡的使用體驗:
- 內容過濾:限制成熟內容的輸出,並過濾動態以移除對青少年帳號有害或不適齡的素材。
- 社交限制:青少年個人檔案不會向成人推薦,且成人不得主動與青少年發送訊息。
- 家長控制:透過 ChatGPT,家長可管理直接訊息,並為子女選擇非個人化的動態。
- 使用限制:預設情況下,青少年在 Sora 應用程式內的連續捲動次數受到限制。
內容過濾與傷害防止
Sora 採用分層防禦,在提示與輸出階段皆阻擋不安全內容。防護欄透過掃描影片畫格與音訊文字稿,針對性內容、恐怖主義宣傳以及自我傷害的宣揚進行過濾。
在生成階段之外,自動系統會根據 OpenAI 的全球使用政策掃描所有動態內容,並針對高影響力的傷害加入人工審查。OpenAI 指出,由於 Sora 2 的動作與音訊更具真實感,相關政策相較於影像生成已進一步收緊。
音訊與音樂保護
為因應音訊生成的風險,Sora 實施以下保護措施:
- 語音掃描:生成語音的文字稿會自動掃描是否違反政策。
- 音樂保護:系統會阻止試圖生成模仿在世藝術家或既有作品的音樂。
- 下架請求:OpenAI 會遵從認為 Sora 輸出侵害其作品的創作者的下架請求。
使用者控制與求助
使用者在應用程式內保有對其內容與社交互動的控制權:
- 分享控制:只有在使用者明確選擇的情況下,影片才會分享到動態。
- 檢舉與封鎖:所有影片、個人檔案、直接訊息、評論與角色皆可檢舉濫用。
- 封鎖:使用者可封鎖帳號,以防止他人查看其個人檔案、存取其角色或發送直接訊息。
Sources
- OriginalCreating with Sora Safely