DrewThomasson/ebook2audiobook
Generate audiobooks from e-books, voice cloning & 1158+ languages!
何を解決するか
Ebook2audiobook (E2A) は、DRMが適用されていない電子書籍を、チャプターとメタデータを備えた高品質なオーディオブックに変換します。さまざまなAI駆動のテキスト読み上げ(TTS)エンジンを使用して、デジタル書籍を音声に変換する方法を提供し、膨大な言語とフォーマットをサポートしています。
どうやって動くか
このツールは電子書籍ファイル(例:.epub や .mobi)を処理し、選択されたTTSエンジンを使って音声を合成します。GradioベースのWebインターフェースまたはヘッドレスCLIモードで実行できます。XTTSv2、Bark、Tortoise などの複数のTTSエンジンから選択でき、特定の声を模倣するための音声クローンファイルをオプションで提供できます。画像ベースのテキストページのOCRスキャンや、一時停止や声の切り替えを細かく制御するためのSMLタグもサポートしています。
誰に向けているか
合法的なDRMなしの電子書籍コレクションをオーディオブックに変換したい読者、および高度なTTSモデルを使ってオーディオブックの声や読み上げ速度をカスタマイズしたいユーザー。
特徴
- 多数のエンジン対応:
XTTSv2、Bark、Fairseq、VITS、Tacotron2、Tortoise、GlowTTS、YourTTSなど複数のTTSエンジンをサポート。 - 広範な言語対応:1158の言語および方言に対応。
- 柔軟なフォーマット:
.epub、.pdf、.mobi、.docxなど多様な入力フォーマットを変換可能。出力は.m4b、.mp3、.flacなど複数の音声フォーマットに対応。 - 音声クローン:カスタム音声ファイルを使って音声をクローン可能。
- 低リソース要件:2GB RAMと1GB VRAMで動作可能。
- SMLタグ:
[break]、[pause]、[voice]などのタグで手動で音声制御が可能。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト