shootthesound/comfyUI-Realtime-Lora
Train and block edit and save LoRAs directly inside ComfyUI for Z-image, Flux Klein, SDXL, Flux, WAN 2.2, SD 1.5
解决的问题
该工具包在 ComfyUI 内提供了一个统一的界面,用于训练、分析和选择性加载多种图像和视频生成模型的 LoRA(低秩适配)。它消除了在不同外部训练软件之间切换的需要,允许用户微调模型中特定模块如何受到 LoRA 的影响,从而对最终输出实现更精细的控制。
如何工作
该项目将三种主要训练后端——sd-scripts、Musubi Tuner 和 AI-Toolkit——直接集成到 ComfyUI 节点中。它提供了一套适用于模型流水线不同阶段的工具:
- 训练:支持 SDXL、SD 1.5、FLUX、Z-Image、Qwen Image 和 Wan 2.2 等模型的专用节点,可从图像中实时进行训练。
- 分析与选择性加载:"Analyzer" 节点可检测 LoRA 格式(如 Standard、LoKR、LoHa),并识别出影响最大的模块。"Selective Loader" 节点则允许用户切换或调整单个模块或层的强度。
- 强度调度:V2 节点支持使用关键帧和预设(如淡入淡出、脉冲)以不同强度应用 LoRA。
- 深度去偏器与检查器:这些节点超越了模块级控制,可对 DIT、VAE 和文本编码器的各个子组件(注意力头、MLP、归一化层)进行缩放,以修复偏差或微调行为。
适用人群
希望训练自定义主题或风格,并对 LoRA 如何应用于基础模型拥有精确、手术式控制的数字艺术家、AI 研究人员和 ComfyUI 用户。
主要亮点
- 多后端支持:统一访问 sd-scripts、Musubi Tuner 和 AI-Toolkit。
- 广泛模型兼容性:支持 SDXL、SD 1.5、FLUX(含 Klein 4B/9B)、Z-Image、Qwen Image 和 Wan 2.2。
- 手术级控制:支持对 DIT、VAE 和文本编码器进行模块级和子组件级(Deep Debiaser)编辑。
- 动态应用:支持 40 多种预设的强度调度,可在生成过程中动态调整 LoRA 的影响。
- 集成工作流:无需离开 ComfyUI 界面即可完成 LoRA 的训练与应用。
相关
- 项目
- 项目
- 项目
- 项目
- 项目