dbccccccc/ttsfm

TTSFM mirrors OpenAI's TTS service, providing a compatible interface for text-to-speech conversion with multiple voice options for free.

解決的問題

TTSFM 提供免費的 OpenAI 相容 API 服務,用於將文本轉換為自然聽感的語音。它充當 openai.fm 後端的橋樑,允許使用者在無需直接使用 OpenAI 官方付費服務的情況下,將高品質的文本轉語音 (TTS) 功能整合到其應用程式中。

工作原理

該專案是 openai.fm 服務的逆向工程實現。它提供了一個模擬 OpenAI TTS 端點的 RESTful API、用於同步與非同步請求的 Python SDK,以及用於即時串流的 WebSocket。為了處理進階音訊處理——例如速度調節(0.25x 至 4.0x)以及六種不同音訊格式之間的轉換——它在完整的 Docker 鏡像版本中使用 ffmpeg。

適用對象

需要為專案提供 OpenAI 相容 TTS 介面的開發人員與研究人員,以及希望透過 Docker 輕鬆部署 TTS 伺服器或使用 Python 函式庫從文本生成語音的使用者。

亮點

  • OpenAI 相容性:可作為 OpenAI TTS API 的即插即用替代方案。
  • 廣泛的音訊選項:支援 11 種不同的聲音與 6 種音訊格式 (MP3, WAV, OPUS, AAC, FLAC, PCM)。
  • 長文本處理:自動分割並合併適用於任何長度內容的音訊。
  • 靈活的部署:提供用於進階功能的完整 Docker 鏡像與用於基本功能的精簡鏡像。
  • 整合工具:包括用於測試與實驗的 Web 遊樂場 (playground) 與 Python SDK。

相關

  • 專案
  • Dispatch
  • 專案
  • 專案
  • 專案