Eddycrack864/UVR5-UI

Ultimate Vocal Remover 5 with Gradio UI. Separate an audio file into various stems, using multiple models

解決的問題

本專案為 python-audio-separator(UVR5 的 CLI 版本)提供一個使用者友善的圖形介面,讓偏好 GUI 而非命令列工具的使用者能輕鬆使用高品質的音訊來源分離功能。

運作方式

它作為多種音訊分離模型的封裝器運作。支援包括 VR Arch、MDX-NET、Demucs v4、MDX23C、Mel-Band Roformer 與 BS Roformer 在內的廣泛架構,允許使用者從混音中分離出特定聲音或人聲。

適用對象

需要從音訊與影片檔案中分離人聲或樂器的音樂人、音訊工程師與內容創作者,包含直接從 yt_dlp 支援的平台取得的素材。

主要特色

  • 廣泛模型支援:支援 VR Arch、MDX-NET、Demucs v4 與 Roformer 模型。
  • 批次處理:可一次處理多個檔案。
  • 直接連結分離:可透過 yt_dlp 支援的網站,直接從影片/音訊來源分離音訊。
  • 跨平台支援:支援 Windows、Linux 以及 Colab、Kaggle 與 Hugging Face Spaces 等雲端環境。

相關

  • 專案
  • 專案
  • 專案
  • 專案