devnen/Chatterbox-TTS-Server
Self-host the powerful Chatterbox TTS model. This server offers a user-friendly Web UI, flexible API endpoints (incl. OpenAI compatible), predefined voices, voice cloning, and large audiobook-scale text processing. Runs accelerated on NVIDIA (CUDA), AMD (ROCm), and CPU.
解決的問題
Chatterbox TTS Server 為自託管 Resemble AI 的 Chatterbox 文本轉語音 (TTS) 系列提供了一種使用者友好的方式。它簡化了這些模型的部署與使用,透過添加現代化的 Web UI 與相容 OpenAI 的 API,無需複雜的手動設定即可實現高品質的語音生成。
工作原理
該專案將 chatterbox-tts 引擎封裝在 FastAPI 伺服器中。它支援三種不同的模型:高品質的 Original Chatterbox(英語)、Chatterbox Multilingual(23 種語言)以及 Chatterbox-Turbo(精簡快速模型)。使用者可以透過 UI 中的熱插拔選擇器在這些引擎之間進行切換。該伺服器處理 NVIDIA、AMD 與 Apple Silicon GPU 的硬體加速,並包含一個智慧分塊系統,可將長文本拆分為易於管理的片段,從而生成無縫的有聲書或長篇旁白。
適用對象
構建語音代理的開發人員、製作有聲書的創作者,以及希望擁有具備語音複製與多語言支援的具表現力強的自託管 TTS 系統的使用者。
亮點
- 多引擎支援: 無需重啟伺服器即可在 Original、Multilingual 與 Turbo 模型之間進行熱插拔切換。
- 豐富的語音控制: Chatterbox-Turbo 支援
[laugh]、[cough]與[chuckle]等副語言標籤,以實現自然的反應。 - 有聲書生成: 智慧文本分塊允許將整本書處理成單個音訊檔案。
- 廣泛的硬體相容性: 原生支援 CUDA、ROCm 與 Apple MPS,包括無需安裝系統 Python 的可攜式 Windows 模式。
- 相容 OpenAI 的 API: 允許輕鬆整合到現有的 AI 工作流與應用程式中。
相關
- 專案
- 專案
- 專案
- 專案
- 專案