pixaroma/ComfyUI-Pixaroma

Pixaroma ComfyUI Nodes

什麼是 ComfyUI‑Pixaroma

ComfyUI‑Pixaroma 是一個 預先設定好的節點集合,可擴展開源的視覺工作流程編輯器 ComfyUI。ComfyUI 讓您透過在畫布上連接模塊來建立影像生成流程(載入模型、執行取樣器、套用後處理等)。Pixaroma 則增加了大量 日常使用工具——載入與調整影像大小、裁切、修補繪圖、3D 場景建構、音訊反應式影片、LoRA 管理、文字串接等——全部包裝成使用者友善的 UI 面板。

此程式庫提供節點定義、少量範例工作流程,以及內建於 ComfyUI 的幫助系統。目標是讓藝術家與開發者在使用擴散模型時,獲得更流暢、更像設計軟體的體驗。


主要功能(如 README 所述)

類別 節點 / 工具 功能說明
影像處理 Load Image / Load Image Mini / Load Images from Folder ComfyUI 原生載入器的即插即用替代品,內建調整大小、重取樣、長寬比預設值與即時預覽功能。
Image Crop / Image Uncrop / Resize Crop 視覺化裁切介面,保留透明度,匯出裁切資訊以供後續重新插入,以及簡單的裁切填滿節點。
Image Resize / Longest Side 單一節點調整大小,支援多種模式(縮放、適應、補白、裁切填滿)與即時長寬比預覽。
Image Compare 兩側並列或疊加比較,搭配滑桿以察覺差異。
繪圖與編輯 Paint Pixaroma 基於圖層的繪圖編輯器,支援自訂筆刷、揉擦與橡皮擦——適用於遮罩或細節處理。
Inpaint Crop / Inpaint Stitch 引導式修補繪圖流程:繪製遮罩、自動裁切出模型友好的區域、執行任何修補模型,再將結果拼接回原圖。
構圖 Image Composer 多圖層畫布,可排列多張影像,每層支援模糊、縮放/旋轉,以及 AI 驅動的背景移除。
3D 支援 3D Builder 簡易的 3D 場景編輯器(形狀、匯入模型、光源、相機),可用於產生參考深度圖或 ControlNet 輸入。
音訊反應式影片 AudioReact Pixaroma 將靜態影像 + 音訊軌轉換為短影片,支援 15 種動畫模式(脈衝、震動、故障等)與多層視覺效果;直接輸出為 MP4。
參數掃描 XY Plot Pixaroma 無需額外接線,即可以格狀方式比較任何節點參數(數值、取樣器、LoRA、提示詞);種子值保持鎖定,確保公平比較。
LoRA 管理 LoRA Loader Pixaroma 單一節點內可堆疊無限多個 LoRA,可切換開關、設定強度、檢視觸發詞,支援可選的 Civitai 查詢(API 金鑰本地儲存)。
文字工具 Text Join Pixaroma 合併最多四行文字,每行可手動輸入或連接,支援自訂分隔符與行名重命名。
Pause Text Pixaroma 斷點功能,顯示已生成的文字,讓您在流程繼續前編輯或重新產生。
工作流程助手 Pixaroma Workflows panel, Pixaroma Help, Pause Image, Save MP4, Notes & Labels, Resolution, Switches UI 面板,用於搜尋、重命名、複製工作流程;每個節點的內嵌幫助;檢查點可讓您預覽或跳過耗時步驟。

所有節點皆支援 ComfyUI 常見的輸入/輸出(例如 IMAGE, MASK, WIDTH, HEIGHT, FILENAME),並可在傳統與新版節點介面中運作。


哪些人會使用它?

  • 已經使用 ComfyUI 進行擴散式影像生成的 藝術家與創作者,希望在不離開畫布的情況下,獲得更像 Photoshop 的工具箱。
  • 進行多步驟流程(載入影像 → 裁切 → 修補 → 放大 → 比較)的 研究人員或愛好者,希望為這些步驟使用視覺化編輯器。
  • 希望快速將靜態 AI 生成影像轉換為短篇音訊反應式影片的 內容生產者
  • 任何需要管理大量 LoRA 的使用者,希望有一種緊湊方式切換與設定權重,同時方便取得觸發詞元資料。

如何開始使用(依 README 所述)

  1. 安裝 – 按照 README 中的「📥 安裝」連結(通常將程式庫 git clone 到 ComfyUI 的 custom_nodes 資料夾,並重新啟動 ComfyUI)。
  2. 重新整理 UI – 安裝後,強制重新整理 ComfyUI 瀏覽器標籤(Ctrl+Shift+R / Cmd+Shift+R),以載入新的節點圖示。
  3. 探索 – 開啟橙色的 W(工作流程)或 ?(幫助)面板,瀏覽範例工作流程並閱讀節點文件。
  4. 試用範例 – 下載提供的 JSON 工作流程檔案之一(例如 Image ComposerAudioReact),透過 ComfyUI UI 載入,觀察節點實際運作。
  5. 尋求協助 – 若遇到問題,請在連結的 Discord 的 #pixaroma‑nodes 頻道提問,或在 GitLab 鏡像上開立問題回報。

為何它很重要

ComfyUI 是一個強大但低階的圖形編輯器;即使建立簡單的流程,也可能需要許多微小的節點(載入 → 調整大小 → 遮罩 → 放大等)。Pixaroma 將這些常見步驟打包成 單一、功能豐富的節點,並加入 視覺化編輯器(裁切、繪圖、3D、音訊反應),減少切換至外部工具的需求。這能加速原型開發,提升工作流程的可重現性,並降低非技術創作者嘗試擴散模型、LoRA 及相關 AI 生成媒體的門檻。


TL;DR

ComfyUI‑Pixaroma 是 ComfyUI 擴散工作流程編輯器的 外掛套件,提供一系列使用者友善的節點,用於影像載入、編輯、構圖、3D 場景建構、音訊反應式影片、LoRA 管理與工作流程工具。這是一個真實、專注於 AI 的開源專案,旨在讓複雜的影像生成流程更易於建立與使用。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案