nkxx188/ComfyUI-MiniMaxH3-Easy
The easiest way to use MiniMax H3. One compact workflow for T2V, I2V, first/last-frame, and reference video generation, with a unified multi-media input, powerful @ references, and inline dialogue blocks. Less wiring. More creative control.
解决的问题
该项目为在 ComfyUI 中使用 MiniMax H3 视频生成模型提供了一个简化的高级接口。它用一个紧凑的「Easy」节点替代了复杂的多节点设置,该节点可管理提示词、媒体输入和模型配置,同时保持与 ComfyUI 生态系统其余部分的兼容性,用于采样和后期处理。
如何工作
系统围绕一个核心「Easy」节点展开,该节点处理文本到视频、图像到视频以及基于参考的视频生成的核心逻辑。
- 媒体处理:使用独特的多链接
Media端口,允许将图像、视频和音频连接到单一输入,节点随后独立编号并追踪它们。 - 提示词:提供一个结构化编辑器,支持通过
@引用连接的媒体和通过#对话块表示的语音/歌词,这些内容将被转换为 MiniMax H3 所需的特定标签。 - 提示词优化:一个可选的内置工具可通过外部 API(OpenAI、Gemini)根据模式感知指南重写提示词,以提升生成质量。
- 模型管理:捆绑加载器处理必要的转换器、文本编码器和 VAE,但为希望使用自定义加载器(包括 GGUF 变体)的用户提供了「Model Bridge」。
- 双通道工作流:包含一个专用的第二通道条件节点,可在不出现关键帧错位问题的情况下实现高分辨率精炼。
适用人群
希望无需手动配置数十个节点即可使用 MiniMax H3 视频生成功能的 ComfyUI 用户,以及需要对 AI 视频中的参考媒体和对话进行精确控制的创作者。
主要亮点
- 统一媒体端口:通过不同线缆颜色和快速创建菜单,将多个图像、视频和音频片段连接到一个端口。
- @ 引用编辑器:使用选择器轻松在提示词中为连接的媒体打标签。
- 对话块:专用于创建对话和歌词的语法,生成过程中可保持原样。
- API 驱动提示词优化器:集成 OpenAI 和 Gemini 支持,使用特定 H3 场景指南重写提示词。
- 第二通道精炼:专为改变分辨率的第二通道设计的工具,以保持构图和时间一致性。
- 灵活的模型加载:支持捆绑加载和自定义模型桥接,兼容 GGUF 和 safetensors 文件。
相关
- 项目
- Dispatch
- 项目
- 项目
- 项目