christian-byrne/audio-separation-nodes-comfyui
Separate stems (vocals, bass, drums, other) from audio. Recombine, tempo match, slice/crop audio
What it solves
该项目提供了一ชุด custom 节点用于 ComfyUI,允许用户操纵和分离音频轨道。它解决了从混合音频文件或视频中分离出特定声音元素(如人声或鼓声)的问题,以及在基于节点的 workflow 模式下执行基础音频编辑任务,如速度匹配与裁剪。
How it works
该工具包集成了 Hybrid Demucs,将音频拆分为四个不同的声部:低音(bass)、鼓声(drums)、人声(vocals)以及“其他”(包括吉他、键盘等乐器)。它还包括用于合并波形、改变速度、通过起始点检测(onset detection)来匹配两条轨道的节奏,以及在视频文件中替换音频轨道的实用节点。
Who it’s for
它专为想要将音频处理、混流、人声分离集成到生成式 AI workflow 中 ComfyUI 用户而设计,例如将视频中的背景音乐替换为 AI 生成的音频。
Highlights
- AI-powered separation: 使用 Hybrid Demucs 分离人声、鼓声、低音以及其他乐器。
- Tempo synchronization: 使用工具检测 BPM 并通过时间伸缩(time-stretch)来匹配不同轨道的节奏。
- Video integration: 能够将将视频文件的音频轨道替换为新的音频来源。
- Waveform manipulation: 用于裁剪音频并使用数学运算(加、平均、减、乘、除)来合并轨道的节点。
相关
- 项目
- 项目
- 项目
- 项目