dbccccccc/ttsfm

TTSFM mirrors OpenAI's TTS service, providing a compatible interface for text-to-speech conversion with multiple voice options for free.

解决的问题

TTSFM 提供免费的 OpenAI 兼容 API 服务,用于将文本转换为自然听感的语音。它充当 openai.fm 后端的桥梁,允许用户在无需直接使用 OpenAI 官方付费服务的情况下,将高质量的文本转语音 (TTS) 功能集成到其应用程序中。

工作原理

该项目是 openai.fm 服务的逆向工程实现。它提供了一个模拟 OpenAI TTS 端点的 RESTful API、用于同步和异步请求的 Python SDK,以及用于实时流传输的 WebSocket。为了处理高级音频处理——例如速度调节(0.25x 至 4.0x)和六种不同音频格式之间的转换——它在完整的 Docker 镜像变体中使用 ffmpeg。

适用对象

需要为项目提供 OpenAI 兼容 TTS 接口的开发人员和研究人员,以及希望通过 Docker 轻松部署 TTS 服务器或使用 Python 库从文本生成语音的用户。

亮点

  • OpenAI 兼容性:可作为 OpenAI TTS API 的即插即用替代方案。
  • 广泛的音频选项:支持 11 种不同的声音和 6 种音频格式 (MP3, WAV, OPUS, AAC, FLAC, PCM)。
  • 长文本处理:自动分割并合并适用于任何长度内容的音频。
  • 灵活的部署:提供用于高级功能的完整 Docker 镜像和用于基本功能的精简镜像。
  • 集成工具:包括用于测试和实验的 Web 游乐场 (playground) 和 Python SDK。

相关

  • 项目
  • Dispatch
  • 项目
  • 项目
  • 项目