SamurAIGPT/Seedance-2.5-API

Python wrapper for ByteDance's Seedance 2.5 API — Text-to-Video, Image-to-Video, realistic human faces, native 4K, consistent character generation.

何が解決されるか

このプロジェクトは、ByteDanceによって開発されたSeedance 2.5 APIの包括的なPythonラッパーを提供し、開発者がプログラムで高品質なAIビデオを生成できるようにします。テキストプロンプト、静止画像、またはマルチモーダル参照の組み合わせからシネマティッククリップを作成するプロセスを簡素化し、異なるシーン間で人間の顔とキャラクターのアイデンティティを一貫させるという課題に特化して対応します。

どうやって動作するか

このライブラリは、MuAPIを介して提供されるSeedance 2.5モデルのSDKとして機能します。さまざまなエンドポイントとやり取りする高レベルのPythonメソッドを提供し、以下を含みます:

  • **Text-to-Video (T2V)およびImage-to-Video (I2V)**の生成。
  • Omni-Reference: 最大30枚の画像、10本のビデオ、10のオーディオクリップを同時に使用してビデオ生成を条件付けます。
  • Character Consistency: ユーザーが1〜3枚の参照写真から4Kキャラクターシートを作成し、その後一意のID(@character:<id>)を使ってそのキャラクターを参照したり、シートをアンカー画像として使用して高い忠実度を得る専門的なワークフローです。
  • Video Editing: テキストと画像プロンプトを使用して既存のビデオを変更します。
  • Synced Audio: マッチしたボイス、サウンドエフェクト、バックグラウンドミュージックを生成します。

対象者

  • AI Video Creators: 現実的な人間の顔を持つ高品質なシネマティッククリップを制作したい人々。
  • Developers: ByteDanceのビデオ生成モデルのための堅牢なPythonインターフェースを必要とするAIビデオアプリケーションまたはSaaSプラットフォームを構築している人々。
  • AI Agents: このプロジェクトには、MCP(Model Context Protocol)サーバーが含まれており、ClaudeやCursorなどのAIモデルがビデオ生成ツールを直接トリガーできるようになります。

ハイライト

  • Extended Clip Length: 30秒までのクリップをサポートします。
  • Realistic Human Faces: 「アンシーニー・バレー」を避けるため、顔の忠実度とアイデンティティの一貫性に特化した焦点を当てます。
  • Multimodal Conditioning: 1つのリクエストで画像、ビデオ、オーディオを参照として使用できる機能。
  • idée Fixed-Camera Control: モデルを静止ショットに偏らせる camera_fixed オプション。
  • High-Fidelity Formats: 色のドリフトやオーディオの非同期を防ぐため、反復編集中に .mov (yuv444p + PCM audio) をサポートします。
  • Permissive Content Policy: 多くの競合するAIビデオモデルと比較して、より柔軟なコンテンツポリシー。