spotify/pedalboard

🎛 🔊 A Python library for audio.

解決的問題

Pedalboard 是一個旨在為 Python 環境帶來錄音室級音訊效果與處理能力的 Python 函式庫。它消除了使用數位音訊工作站 (DAW) 進行複雜音訊轉換的需求,使得將專業音訊效果整合到自動化工作流、內容創作和機器學習流水線中變得更加容易。

工作原理

該函式庫為核心音訊處理引擎(基於 JUCE)提供高階 Python 介面。它允許使用者建立一個「pedalboard」(音訊插件鏈)並透過它們處理音訊。它支援讀取與寫入各種音訊格式(AIFF, FLAC, MP3, OGG, WAV),並提供內建效果,如混響、合唱和壓縮器。至關重要的是,它允許載入第三方 VST3 和 Audio Unit 插件,從而可以在 Python 程式碼中直接使用專業軟體樂器與效果器。

適用對象

  • 機器學習工程師:那些使用音訊數據進行模型訓練,特別是透過數據增強來提高模型魯棒性的人員。
  • 音訊開發人員:希望在沒有 DAW 的情況下,透過程式化方式應用音訊效果或建立音訊渲染流水線的人員。
  • AI 研究人員:從事基於音訊的 AI 研究的人員,例如 AI DJ 或語音翻譯工具。

亮點

  • 專業插件支援:支援用於第三方效果器與樂器的 VST3 和 Audio Unit 格式。
  • 高性能:處理音訊的速度明顯快於 pySoX 和 librosa.load,並釋放 Python GIL 以利用多核 CPU。
  • 機器學習整合:已通過 TensorFlow 相容性測試,可以直接在 tf.data 流水線中使用。
  • 即時音訊:透過 AudioStream 支援即時音訊操作,用於即時輸入/輸出。
  • 跨平台:可在 macOS、Windows 和 Linux 上執行。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案