shootthesound/comfyUI-Realtime-Lora
Train and block edit and save LoRAs directly inside ComfyUI for Z-image, Flux Klein, SDXL, Flux, WAN 2.2, SD 1.5
解決的問題
此工具包在 ComfyUI 內提供統一介面,用於訓練、分析與選擇性載入多種影像與影片生成模型的 LoRA(低秩適應)。它消除了切換不同外部訓練軟體的需要,並允許使用者微調模型中特定模組如何受到 LoRA 的影響,從而對最終輸出實現更細緻的控制。
如何運作
此專案將三種主要訓練後端——sd-scripts、Musubi Tuner 和 AI-Toolkit——直接整合至 ComfyUI 節點中。它提供一套適用於模型流程不同階段的工具:
- 訓練:支援 SDXL、SD 1.5、FLUX、Z-Image、Qwen Image 和 Wan 2.2 等模型的專用節點,可從影像中即時訓練。
- 分析與選擇性載入:"Analyzer" 節點可偵測 LoRA 格式(例如 Standard、LoKR、LoHa),並識別出影響最大的模組。"Selective Loader" 節點則允許使用者切換或調整單一模組或層的強度。
- 強度排程:V2 節點支援使用關鍵幀與預設(例如漸入漸出、脈衝)以不同強度套用 LoRA。
- 深度去偏器與檢查器:這些節點超越模組級控制,可對 DIT、VAE 和文字編碼器的個別子元件(注意力頭、MLP、歸一化)進行縮放,以修正偏差或微調行為。
適用對象
希望訓練自訂主題或風格,並對 LoRA 如何應用於基礎模型擁有精確、手術式控制的數位藝術家、AI 研究人員與 ComfyUI 使用者。
主要亮點
- 多後端支援:統一存取 sd-scripts、Musubi Tuner 與 AI-Toolkit。
- 廣泛模型相容性:支援 SDXL、SD 1.5、FLUX(含 Klein 4B/9B)、Z-Image、Qwen Image 與 Wan 2.2。
- 手術級控制:支援對 DIT、VAE 與文字編碼器進行模組級與子元件級(Deep Debiaser)編輯。
- 動態應用:支援 40 種以上預設的強度排程,可在生成過程中動態調整 LoRA 的影響。
- 整合工作流程:無需離開 ComfyUI 界面即可完成 LoRA 的訓練與應用。
相關
- 專案
- 專案
- 專案
- 專案
- 專案