SamurAIGPT/Seedance-2.5-API

Python wrapper for ByteDance's Seedance 2.5 API — Text-to-Video, Image-to-Video, realistic human faces, native 4K, consistent character generation.

它解决的问题

此项目提供了一个全面的 Python 包装器,用于 Seedance 2.5 API(由 ByteDance 开发),使开发者能够以编程方式生成高保真 AI 视频。它简化了从文本提示、静态图像或多模态引用的组合创建电影剪辑的过程,同时专门解决了在不同场景中保持人脸一致性和角色身份的挑战。

它是如何工作的

该库充当通过 MuAPI 交付的 Seedance 2.5 模型的 SDK。它提供高级 Python 方法,以与各种端点进行交互,包括:

  • Text-to-Video (T2V)Image-to-Video (I2V) 生成。
  • Omni-Reference:同时对多达 30 张图像、10 个视频和 10 个音频片段进行视频生成的条件设置。
  • Character Consistency:一种专门的工作流程,用户可以从 1-3 张参考照片创建一个 4K 角色表,然后通过使用唯一 ID (@character:<id>) 引用该角色,或将该表作为锚图像以获得更高的保真度。
  • Video Editing:使用文本和图像提示修改现有视频。
  • Synced Audio:生成匹配的语音、音效和背景音乐。

它适用于谁

  • AI Video 创作者:那些希望以逼真的人脸制作高质量电影剪辑的人。
  • 开发者:那些构建需要强大 Python 接口以使用 ByteDance 视频生成模型的 AI 视频应用或 SaaS 平台的人。
  • AI 代理:该项目包含一个 MCP (Model Context Protocol) 服务器,使得像 Claude 或 Cursor 这样的 AI 模型能够直接触发视频生成工具。

亮点

  • Extended Clip Length:支持长达 30 秒的剪辑。
  • Realistic Human Faces:专注于面部保真度和身份一致性,以避免“uncanny valley”。
  • Multimodal Conditioning:能够在单个请求中使用图像、视频和音频作为引用。
  • idée Fixed-Camera Control:一个 camera_fixed 选项,用于倾向于静态镜头的模型偏置。
  • High-Fidelity Formats:支持 .mov (yuv444p + PCM audio) 格式,以防止在重复编辑过程中出现颜色漂移和音频不同步。
  • Permissive Content Policy:相比许多竞争的 AI 视频模型,具有更灵活的内容政策。