Lightricks/ComfyUI-LTXVideo

LTX-Video Support for ComfyUI

解决的问题

本项目为 ComfyUI 提供了一套自定义节点和工作流,旨在充分利用 LTX-2 视频生成模型。通过添加高级控制机制、高动态范围 (HDR) 输出、音频生成和创意放大工具,扩展了核心的 ComfyUI LTX-2 集成功能。

工作原理

它将多个专门的 LoRA (Low-Rank Adaptation) 和自定义节点集成到 ComfyUI 的基于图形的界面中。其中包括:

  • Union IC-LoRA: 一个统一的模型,通过使用下采样潜变量同时处理深度和边缘 (Canny) 控制信号,实现更快的推理。
  • HDR IC-LoRA: 在 ARRI LogC3 空间中生成视频,然后将其解码为线性 HDR 值,用于专业调色和 EXR 导出。
  • Dub-It IC-LoRA: 一种多语言配音工具,在保留说话者身份的同时,重新生成口型和音频以匹配目标文本提示。
  • Pixel Spatial Upscaler: 一种生成式放大器,通过合成新的细节(2x 或 4x)而非仅仅对像素进行插值。
  • Audio-Only Mode: 利用联合音频/视频 Transformer,在不生成视频的情况下从文本生成音频。

适用对象

使用 ComfyUI 并拥有高显存 GPU(建议 32GB+)的视频内容创作者、VFX 艺术家和 AI 视频研究人员,用于生成受控的高质量视频和音频内容。

亮点

  • 统一控制:将深度和边缘控制合并到单个 LoRA 中。
  • 专业 HDR:支持线性 HDR 输出和 16/32 位 EXR 图像序列。
  • AI 配音:多语言语音重述和对口型。
  • 生成式放大:添加合成纹理和结构的创意空间放大。
  • 联合音频/视频:能够独立执行文本转音频生成。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目