Lightricks/ComfyUI-LTXVideo

LTX-Video Support for ComfyUI

解決的問題

本專案為 ComfyUI 提供了一套自定義節點與工作流,旨在充分利用 LTX-2 影片生成模型。透過加入進階控制機制、高動態範圍 (HDR) 輸出、音訊生成與創意放大工具,擴展了核心的 ComfyUI LTX-2 整合功能。

工作原理

它將多個專門的 LoRA (Low-Rank Adaptation) 與自定義節點整合到 ComfyUI 的圖形化介面中。其中包括:

  • Union IC-LoRA:一個統一的模型,透過使用下採樣潛變量同時處理深度與邊緣 (Canny) 控制訊號,實現更快的推理。
  • HDR IC-LoRA:在 ARRI LogC3 空間中生成影片,然後將其解碼為線性 HDR 值,用於專業調色與 EXR 匯出。
  • Dub-It IC-LoRA:一種多語言配音工具,在保留說話者身份的同時,重新生成口型與音訊以匹配目標文本提示。
  • Pixel Spatial Upscaler:一種生成式放大器,透過合成新的細節(2x 或 4x)而非僅僅對像素進行插值。
  • Audio-Only Mode:利用聯合音訊/影片 Transformer,在不產生影片的情況下從文本生成音訊。

適用對象

使用 ComfyUI 並擁有高顯存 GPU(建議 32GB+)的內容創作者、VFX 藝術家與 AI 影片研究人員,用於生成受控的高品質影片與音訊內容。

亮點

  • 統一控制:將深度與邊緣控制合併到單個 LoRA 中。
  • 專業 HDR:支援線性 HDR 輸出與 16/32 位元 EXR 圖像序列。
  • AI 配音:多語言語音重述與對口型。
  • 生成式放大:添加合成紋理與結構的創意空間放大。
  • 聯合音訊/影片:能夠獨立執行文本轉音訊生成。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案