DrewThomasson/ebook2audiobook
Generate audiobooks from e-books, voice cloning & 1158+ languages!
解决的问题
Ebook2audiobook (E2A) 将非 DRM 电子书转换为带有章节和元数据的高质量有声书。它提供了一种使用多种 AI 驱动的文本转语音(TTS)引擎将数字书籍转换为语音音频的方法,支持大量语言和格式。
如何工作
该工具处理电子书文件(如 .epub 或 .mobi),并使用选定的 TTS 引擎合成语音。可通过基于 Gradio 的 Web 界面运行,也可在无头 CLI 模式下运行。用户可从多个 TTS 引擎(如 XTTSv2、Bark 和 Tortoise)中选择,并可选择性地提供语音克隆文件以模仿特定声音。还支持对图像类文本页面进行 OCR 扫描,以及使用 SML 标签对停顿和语音切换进行细粒度控制。
适用人群
希望将合法的非 DRM 电子书收藏转换为有声书的读者,以及希望使用高级 TTS 模型自定义有声书语音和语速的用户。
特色亮点
- 广泛引擎支持:支持多种 TTS 引擎,包括
XTTSv2、Bark、Fairseq、VITS、Tacotron2、Tortoise、GlowTTS和YourTTS。 - 丰富语言支持:兼容 1158 种语言和方言。
- 灵活格式:可转换多种输入格式(包括
.epub、.pdf、.mobi和.docx),并输出多种音频格式(如.m4b、.mp3和.flac)。 - 语音克隆:可使用自定义语音文件进行语音克隆。
- 低资源需求:最低仅需 2GB 内存和 1GB 显存即可运行。
- SML 标签:支持
[break]、[pause]和[voice]等标签,实现手动音频控制。
相关
- 项目
- 项目
- 项目
- 项目
- 项目