christian-byrne/audio-separation-nodes-comfyui

Separate stems (vocals, bass, drums, other) from audio. Recombine, tempo match, slice/crop audio

What it solves

這項專案提供了一組用於 ComfyUI 的自定義節點,讓使用者能夠操作與分離音訊軌道。它解決了從混合音訊檔案或影片中分離出特定聲音元素(例如人聲或鼓聲)的問題,並能在節點式工作流中執行基本的音訊編輯任務,如速度匹配與裁剪。

How it works

此工具包整合了 Hybrid Demucs,將音訊拆分為四個不同的聲部:低音(bass)、鼓聲(drums)、人聲(vocals)以及「其他」(包含吉他與鍵盤等樂器)。它還包含用於合併波形、改變速度、透過起始點檢測(onset detection)來匹配兩條軌道的節奏,以及在影片檔案中替換音訊軌道的實用節點。

Who it’s for

它專為想要將音訊處理、混音與人聲分離整合到生成式 AI 工作流中的 ComfyUI 使用者而設計,例如將影片中的背景音樂替換為 AI 生成的音訊。

Highlights

  • AI-powered separation: 使用 Hybrid Demucs 分離人聲、鼓聲、低音與其他樂器。
  • Tempo synchronization: 包含檢測 BPM 並對音訊進行時間伸縮(time-stretch)以匹配軌道間的節奏。
  • Video integration: 能夠將影片檔案的音訊軌道替換為新的音訊來源。
  • Waveform manipulation: 用於裁剪音訊與使用數學運算(加、平均、減、乘、除)來合併軌道的節點。

相關

  • 專案
  • 專案
  • 專案
  • 專案