OpenAI Sora 2 系统卡
OpenAI 已发布 Sora 2,这是一款最先进的视频和音频生成模型,旨在提升物理准确性、视觉真实感和音频同步。该模型扩展了创意叙事能力,并作为模拟复杂物理世界动态的研究一步。
Sora 2 的核心能力
Sora 2 在原始 Sora 模型的基础上引入了多项技术进步,重点关注保真度和用户控制。主要改进包括:
- 物理准确性与真实感: 模型实现了更精确的物理效果和更锐利的真实感,使生成内容更贴合真实世界的动态。
- 同步音频: Sora 2 集成了与视频内容同步的音频生成。
- 增强可控性: 模型以更高的保真度遵循用户指令,为创作者提供更精确的输出控制。
- 扩展风格范围: 模型支持更广泛的视觉风格,以满足想象力和创意表达的需求。
部署与可用性
Sora 2 旨在跨多个平台实现易用性。其可用性包括:
- 网页访问: 可通过 sora.com 访问。
- 移动访问: 独立的 iOS Sora 应用程序。
- API 访问: 计划在未来发布。
安全框架与风险缓解
OpenAI 采用迭代部署策略来管理高保真视频和音频生成相关的风险,特别针对未经同意的肖像使用和误导性内容的创建。
红队与迭代安全
OpenAI 与内部红队合作,识别新出现的挑战并制定相应的缓解措施。安全方法采用迭代方式,优先关注上下文关键或风险尚未完全了解的领域。
部署限制
为确保安全推出,OpenAI 实施了以下保障措施:
- 受限访问: 初始访问通过有限邀请提供。
- 上传限制: 系统限制上传包含逼真人物的 视频和图像。
- 未成年人保护: 对所有涉及未成年人的内容实施严格的保障措施和审核阈值。
Sources
- OriginalSora 2 System Card