nomadkaraoke/python-audio-separator

Easy to use stem (e.g. instrumental/vocals) separation from CLI or as a python package, using a variety of amazing pre-trained models (primarily from UVR)

해결하는 문제

Audio Separator는 단일 오디오 파일을 여러 개의 개별 트랙(스템)으로 분할(예: 보컬과 악기 분리)하도록 설계되었습니다. 이는 카라오케 트랙 제작, 노이즈 제거 또는 드럼, 베이스, 피아노, 기타와 같은 특정 악기 분리에 특히 유용합니다.

작동 방식

이 도구는 MDX-Net, VR Arch, Demucs 및 MDXC/RoFormer와 같은 아키텍처를 포함하여 Ultimate Vocal Remover (UVR) 생태계의 사전 학습된 AI 모델을 활용합니다. 처리 속도를 높이기 위해 NVIDIA GPU(CUDA), Apple Silicon(MPS/CoreML) 및 Windows AMD/Intel GPU(DirectML)를 포함한 여러 하드웨어 가속 경로를 지원하며, CPU 처리로의 폴백 기능도 제공합니다.

대상 사용자

자체 Python 프로젝트에 고품질 오디오 스템 분리를 통합하거나 독립 실행형 명령줄 도구로 사용하려는 음악 프로듀서, 카라오케 제작자 및 개발자를 위한 것입니다.

주요 특징

  • 다중 모델 지원: 다양한 악기 및 오디오 작업(예: 노이즈 제거, 에코 제거)을 위해 다양한 특수 모델을 사용합니다.
  • 자동 모델 관리: 최초 사용 시 필요한 모델 파일을 자동으로 다운로드합니다.
  • 폭넓은 하드웨어 가속: CUDA, Apple Silicon 및 DirectML에 최적화되어 다양한 운영 체제에서 빠른 추론을 보장합니다.
  • 유연한 통합: 일괄 처리를 위한 CLI 도구와 맞춤형 소프트웨어 개발을 위한 Python API로 모두 사용할 수 있습니다.
  • 포맷 지원: WAV, MP3, FLAC 및 M4A를 포함한 모든 일반적인 오디오 형식과 호환됩니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트