pixaroma/ComfyUI-Pixaroma

Pixaroma ComfyUI Nodes

什么是 ComfyUI‑Pixaroma

ComfyUI‑Pixaroma 是一个预置节点集合,用于扩展开源视觉工作流编辑器 ComfyUI。ComfyUI 允许您通过在画布上连接模块来构建图像生成管道(加载模型、运行采样器、应用后处理等)。Pixaroma 添加了一个大型工具箱,包含日常使用工具——图像加载与缩放、裁剪、内补绘制、3D 场景构建、音频反应视频、LoRA 处理、文本拼接等——所有功能均封装在用户友好的 UI 面板中。

该仓库包含节点定义、少量示例工作流以及内置于 ComfyUI 中的帮助系统。目标是为使用扩散模型的艺术家和开发者提供更流畅、更“设计软件式”的体验。


主要功能(如 README 所述)

类别 节点 / 工具 功能
图像处理 Load Image / Load Image Mini / Load Images from Folder ComfyUI 原生加载器的即插即用替代品,内置缩放、重采样、宽高比预设和实时预览。
Image Crop / Image Uncrop / Resize Crop 可视化裁剪 UI,保留透明度,导出裁剪信息以供后续重新插入,以及一个简单的裁剪填充节点。
Image Resize / Longest Side 单节点缩放,支持多种模式(缩放、适应、填充、裁剪填充)和实时宽高比预览。
Image Compare 支持滑块的并排或叠加比较,便于发现差异。
绘画与编辑 Paint Pixaroma 基于图层的绘画编辑器,支持自定义画笔、涂抹和橡皮擦——适用于蒙版或细节处理。
Inpaint Crop / Inpaint Stitch 引导式内补绘制工作流:绘制蒙版 → 自动裁剪出模型友好的区域 → 运行任意内补模型 → 将结果缝合回原图。
构图 Image Composer 多图分层排列画布,支持每层模糊、缩放/旋转,以及 AI 驱动的背景移除。
3D 支持 3D Builder 简单的 3D 场景编辑器(形状、导入模型、光照、相机),用于生成参考深度图或 ControlNet 输入。
音频反应视频 AudioReact Pixaroma 将静态图像 + 音频轨道转换为包含 15 种运动模式(脉冲、抖动、故障等)和视觉特效堆栈的短视频,并直接输出为 MP4。
参数扫描 XY Plot Pixaroma 无需额外连线即可对任意节点参数(数值、采样器、LoRA、提示词)进行网格式比较;种子保持锁定以确保公平比较。
LoRA 管理 LoRA Loader Pixaroma 一个节点内可堆叠无限 LoRA,支持开关、设置强度、查看触发词,可选 Civitai 查找(API 密钥本地存储)。
文本工具 Text Join Pixaroma 合并最多四行文本,每行可手动输入或连接,支持自定义分隔符和行重命名。
Pause Text Pixaroma 断点节点,显示生成的文本,允许您在工作流其余部分运行前编辑或重新生成。
工作流助手 Pixaroma Workflows panel, Pixaroma Help, Pause Image, Save MP4, Notes & Labels, Resolution, Switches 用于搜索、重命名、复制工作流的 UI 面板;每个节点的内联帮助;可预览或跳过耗时步骤的检查点。

所有节点均暴露标准 ComfyUI 输入/输出(如 IMAGE, MASK, WIDTH, HEIGHT, FILENAME),在经典和新节点界面中均可使用。


谁会用它?

  • 已使用 ComfyUI 进行基于扩散的图像生成的艺术家和创作者,希望在不离开画布的情况下获得类似 Photoshop 的工具箱。
  • 构建多步骤流程(加载图像 → 裁剪 → 内补 → 放大 → 比较)的研究人员或爱好者,希望为这些步骤使用可视化编辑器。
  • 希望快速将静态 AI 生成图像转换为短音频反应视频的内容制作者。
  • 需要管理大量 LoRA 且希望以紧凑方式切换和加权,同时方便查看触发词元数据的任何人。

如何开始使用(如 README 所述)

  1. 安装 – 按照 README 中的「📥 Install」链接操作(通常将仓库 git clone 到 ComfyUI 的 custom_nodes 文件夹中,然后重启 ComfyUI)。
  2. 刷新 UI – 安装后,强制刷新 ComfyUI 浏览器标签页(Ctrl+Shift+R / Cmd+Shift+R)以加载新节点图标。
  3. 探索 – 打开橙色的 W(工作流)或 ?(帮助)面板,浏览示例工作流并阅读节点文档。
  4. 尝试示例 – 下载提供的 JSON 工作流文件之一(如 Image ComposerAudioReact),通过 ComfyUI UI 加载以查看节点的实际效果。
  5. 寻求帮助 – 如遇问题,请在链接的 Discord 的 #pixaroma‑nodes 频道中提问,或在 GitLab 镜像中提交 Issue。

为什么重要?

ComfyUI 是一个强大但低级别的图编辑器;即使构建简单的管道也可能涉及许多小节点(加载 → 缩放 → 蒙版 → 放大等)。Pixaroma 将这些常规步骤打包为单一、功能丰富的节点,并添加了可视化编辑器(裁剪、绘画、3D、音频反应),减少了在外部工具间切换的需求。这加快了原型开发速度,提高了工作流的可复现性,并降低了非技术创作者尝试扩散模型、LoRA 及相关 AI 生成媒体的门槛。


TL;DR

ComfyUI‑Pixaroma 是 ComfyUI 扩散工作流编辑器的插件包,提供一系列用户友好的节点,用于图像加载、编辑、构图、3D 场景创建、音频反应视频、LoRA 管理和工作流工具。这是一个真正的、以 AI 为中心的开源项目,旨在让复杂的图像生成管道更易于构建和使用。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目