NikoDemon80/ComfyUI-H3-Motion-Context

Clip chaining for MiniMax H3 in ComfyUI - motion and audio genuinely continue across joins

解決する課題

このプロジェクトは、複数の MiniMax H3 動画および音声クリップをチェーン接続し、カットをまたいで動きと音がシームレスに継続するようにする方法を提供します。標準的なアンカリング手法を使用して動画生成を延長しようとした際に発生しがちな、色のドリフト、画像の軟化、音声の「ティック」やリスタートといった一般的な問題を防ぎます。

仕組み

システムは専用ノードを使用して、前のクリップの潜在表現(映像と音声の両方)の末尾をスライスし、次の生成に供給します。ピクセルにデコードして再エンコードするのではなく、直接潜在表現を操作することで、ビット単位の精度を維持し、品質の低下を回避します。また、ピン留めされた音声のタイム座標を書き換えることで、モデルがそれを独立した似たような音のクリップではなく、既存トラックの延長として扱うようにします。

対象者

ComfyUI と MiniMax H3 モデルのユーザーで、接合部に目に見える、あるいは聞こえる継ぎ目なしで、同期した音声を持つより長く一貫性のある動画を作成したい方向けです。

ハイライト

  • 潜在表現ベースのチェーン接続: ピクセルへのデコードによる劣化の往復を回避し、色のドリフトや軟化を防ぎます。
  • 音声の継続: 音声がリスタートしたり「カバーバンド」の模倣のように聞こえたりするのではなく、単一のトラックとして継続することを保証します。
  • H3 モーションコンテキストの保存/読み込み: ComfyUI での循環接続エラーを回避するため、異なる生成実行間で潜在表現を引き継ぐ専用ノード。
  • シームプローブ: 接合部が真の継続なのか、それとも説得力のある模倣なのかを測定する組み込みツール。
  • 安全チェック: ソフトウェアの更新後の不良出力を防ぐため、レンダリング前に ComfyUI の H3 レイアウト演算を自動的に検証します。

関連

  • プロジェクト
  • Dispatch
  • プロジェクト
  • プロジェクト
  • プロジェクト