devnen/Chatterbox-TTS-Server

Self-host the powerful Chatterbox TTS model. This server offers a user-friendly Web UI, flexible API endpoints (incl. OpenAI compatible), predefined voices, voice cloning, and large audiobook-scale text processing. Runs accelerated on NVIDIA (CUDA), AMD (ROCm), and CPU.

解决的问题

Chatterbox TTS Server 为自托管 Resemble AI 的 Chatterbox 文本转语音 (TTS) 系列提供了一种用户友好的方式。它简化了这些模型的部署和使用,通过添加现代化的 Web UI 和兼容 OpenAI 的 API,无需复杂的手动设置即可实现高质量的语音生成。

工作原理

该项目将 chatterbox-tts 引擎封装在 FastAPI 服务器中。它支持三种不同的模型:高质量的 Original Chatterbox(英语)、Chatterbox Multilingual(23 种语言)以及 Chatterbox-Turbo(精简快速模型)。用户可以通过 UI 中的热插拔选择器在这些引擎之间进行切换。该服务器处理 NVIDIA、AMD 和 Apple Silicon GPU 的硬件加速,并包含一个智能分块系统,可将长文本拆分为易于管理的片段,从而生成无缝的有声书或长篇旁白。

适用对象

构建语音代理的开发人员、制作有声书的创作者,以及希望拥有具备语音克隆和多语言支持的表达力强的自托管 TTS 系统的用户。

亮点

  • 多引擎支持: 无需重启服务器即可在 Original、Multilingual 和 Turbo 模型之间进行热插拔切换。
  • 丰富的语音控制: Chatterbox-Turbo 支持 [laugh][cough][chuckle] 等副语言标签,以实现自然的反应。
  • 有声书生成: 智能文本分块允许将整本书处理成单个音频文件。
  • 广泛的硬件兼容性: 原生支持 CUDA、ROCm 和 Apple MPS,包括无需安装系统 Python 的便携式 Windows 模式。
  • 兼容 OpenAI 的 API: 允许轻松集成到现有的 AI 工作流和应用程序中。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目