brailcom/speechd

Common high-level interface to speech synthesis

何を解決するか

Speech Dispatcher は、音声合成(Text-to-Speech)への共通でデバイスに依存しないインターフェースを提供します。これにより、視覚障害者や視覚に障害を持つユーザーが、自由なソフトウェアを使ってコンピュータやインターネットとやり取りできるようになります。下位の音声エンジンを抽象化することで実現されています。

動作方法

クライアントアプリケーションとさまざまな音声合成バックエンドの間に高レベルのレイヤーとして機能します。システムは、パイプを介してシンプルなプロトコルで通信する中央サーバーと、音声モジュールから構成されています。このアーキテクチャにより、ライセンスの異なる C ライブラリ、外部コマンド、HTTP サービスなど、幅広い種類の音声合成エンジンを統合できます。

対象ユーザー

アクセシビリティソフトウェアを開発する開発者、および複数の音声合成エンジンを管理するための安定した、ドキュメントが整ったインターフェースを必要とする視覚障害者や視覚に障害を持つユーザー。

特徴

  • 広範なエンジン対応: Piper、Mary、eSpeak-NG、Festival など、多数の TTS エンジンをサポート。
  • 柔軟なアーキテクチャ: サーバーと合成モジュール間でパイプベースのプロトコルを使用しており、新しいバックエンドの開発が容易です。
  • 多言語バインディング: C、Python、Common Lisp、Guile 用の API ライブラリを提供。Rust および Java バインディングは開発中です。
  • アクセシビリティ重視: 視覚障害者を支援することを目的とした Free(b)soft プロジェクトの一環です。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト