DrewThomasson/ebook2audiobook

Generate audiobooks from e-books, voice cloning & 1158+ languages!

解决的问题

Ebook2audiobook (E2A) 将非 DRM 电子书转换为带有章节和元数据的高质量有声书。它提供了一种使用多种 AI 驱动的文本转语音(TTS)引擎将数字书籍转换为语音音频的方法,支持大量语言和格式。

如何工作

该工具处理电子书文件(如 .epub.mobi),并使用选定的 TTS 引擎合成语音。可通过基于 Gradio 的 Web 界面运行,也可在无头 CLI 模式下运行。用户可从多个 TTS 引擎(如 XTTSv2BarkTortoise)中选择,并可选择性地提供语音克隆文件以模仿特定声音。还支持对图像类文本页面进行 OCR 扫描,以及使用 SML 标签对停顿和语音切换进行细粒度控制。

适用人群

希望将合法的非 DRM 电子书收藏转换为有声书的读者,以及希望使用高级 TTS 模型自定义有声书语音和语速的用户。

特色亮点

  • 广泛引擎支持:支持多种 TTS 引擎,包括 XTTSv2BarkFairseqVITSTacotron2TortoiseGlowTTSYourTTS
  • 丰富语言支持:兼容 1158 种语言和方言。
  • 灵活格式:可转换多种输入格式(包括 .epub.pdf.mobi.docx),并输出多种音频格式(如 .m4b.mp3.flac)。
  • 语音克隆:可使用自定义语音文件进行语音克隆。
  • 低资源需求:最低仅需 2GB 内存和 1GB 显存即可运行。
  • SML 标签:支持 [break][pause][voice] 等标签,实现手动音频控制。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目