thorstenMueller/Thorsten-Voice

Thorsten-Voice: A free to use, offline working, high quality german TTS voice should be available for every project without any license struggling.

何を解決するか

このプロジェクトは、無料でオフラインで利用可能かつライセンスフリーなテキスト音声変換(TTS)システムの作成を可能にする、高品質なオープンソースのドイツ語音声データセットを提供します。開発者がプロプライエタリまたは有料サービスに依存せずに、自然なドイツ語音声をアプリケーションに組み込む際の障壁を排除することを目指しています。

仕組み

Thorsten Müller氏が、さまざまなスタイルや品質のフレーズを数千件録音しました。これらの録音は、いくつかのデータセット(ニュートラル、感情表現、ヘッセン方言)に分類され、標準的な機械学習構造(例:LJSpeech)と互換性のある形式で提供されています。これらのデータセットは、Coqui AI、Piper TTS、Home AssistantなどのAI/ML研究者やプロジェクトによって、ニューラルテキスト音声変換モデルの学習に活用されています。

対象ユーザー

  • AI/ML研究者:新しいドイツ語TTSモデルを訓練する人
  • 開発者:オフラインのドイツ語音声アシスタントやアクセシビリティツールを開発する人
  • スマートホーム愛好家:Home Assistantなどのプラットフォームに高品質なドイツ語音声を統合したい人

特徴

  • 多様なデータセット:ニュートラルな発話、8種類の感情表現の録音、ヘッセン方言を含む
  • 高精細:Hugging Faceで44kHzのフルサンプリングレートデータセットを提供
  • 広範な統合:PiperやCoqui AIといった主要なオープンソースTTSエンジンで既に利用済み
  • 許容性の高いライセンス:CC0ライセンスでリリースされ、プロジェクトや製品での無制限利用が可能

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト