NikoDemon80/ComfyUI-H3-Motion-Context

Clip chaining for MiniMax H3 in ComfyUI - motion and audio genuinely continue across joins

解決的問題

本專案提供了一種將多個 MiniMax H3 影片和音訊片段串接在一起的方法,使動態和聲音在剪接點之間能無縫延續。它防止了使用標準錨定方法嘗試擴充影片生成時常見的問題,例如色彩偏移、影像柔化,以及音訊「滴答聲」或重新開始。

運作方式

該系統使用一個專用節點來擷取前一個片段潛在表示(包含畫面和聲音)的尾部,並將其輸入到下一次生成中。透過直接操作潛空間,而不是將其解碼為像素再重新編碼,它保持了位元級別的精確度並避免了畫質流失。它還會重寫錨定音訊的時間座標,讓模型將其視為現有音軌的延續,而不是一個獨立但聽起來相似的片段。

適用對象

ComfyUI 和 MiniMax H3 模型的使用者,希望創建更長且一致的影片,並帶有同步音訊,在接合點沒有可見或可聽的縫隙。

特色

  • 基於潛空間的串接:避免了解碼為像素所造成的破壞性往返過程,防止色彩偏移和影像柔化。
  • 音訊延續:確保音訊作為單一音軌延續,而不是重新開始或聽起來像「翻唱樂團」的模仿。
  • H3 動態上下文儲存/載入:專用節點,用於在不同的生成執行之間傳遞潛空間,以避免 ComfyUI 中出現循環連線錯誤。
  • 接合探測器:一個內建工具,用於測量接合處是真實的延續還是逼真的模仿。
  • 安全檢查:在算圖前自動驗證 ComfyUI 的 H3 佈局運算,以防止軟體更新後產生錯誤的輸出。

相關

  • 專案
  • Dispatch
  • 專案
  • 專案
  • 專案