spotify/pedalboard
🎛 🔊 A Python library for audio.
解決的問題
Pedalboard 是一個旨在為 Python 環境帶來錄音室級音訊效果與處理能力的 Python 函式庫。它消除了使用數位音訊工作站 (DAW) 進行複雜音訊轉換的需求,使得將專業音訊效果整合到自動化工作流、內容創作和機器學習流水線中變得更加容易。
工作原理
該函式庫為核心音訊處理引擎(基於 JUCE)提供高階 Python 介面。它允許使用者建立一個「pedalboard」(音訊插件鏈)並透過它們處理音訊。它支援讀取與寫入各種音訊格式(AIFF, FLAC, MP3, OGG, WAV),並提供內建效果,如混響、合唱和壓縮器。至關重要的是,它允許載入第三方 VST3 和 Audio Unit 插件,從而可以在 Python 程式碼中直接使用專業軟體樂器與效果器。
適用對象
- 機器學習工程師:那些使用音訊數據進行模型訓練,特別是透過數據增強來提高模型魯棒性的人員。
- 音訊開發人員:希望在沒有 DAW 的情況下,透過程式化方式應用音訊效果或建立音訊渲染流水線的人員。
- AI 研究人員:從事基於音訊的 AI 研究的人員,例如 AI DJ 或語音翻譯工具。
亮點
- 專業插件支援:支援用於第三方效果器與樂器的 VST3 和 Audio Unit 格式。
- 高性能:處理音訊的速度明顯快於 pySoX 和 librosa.load,並釋放 Python GIL 以利用多核 CPU。
- 機器學習整合:已通過 TensorFlow 相容性測試,可以直接在
tf.data流水線中使用。 - 即時音訊:透過
AudioStream支援即時音訊操作,用於即時輸入/輸出。 - 跨平台:可在 macOS、Windows 和 Linux 上執行。
相關
- 專案
- 專案
- 專案
- 專案
- 專案