brailcom/speechd

Common high-level interface to speech synthesis

解決的問題

Speech Dispatcher 提供一個通用且與裝置無關的介面,用於存取語音合成(文字轉語音)。它透過抽象化底層語音引擎,讓視覺障礙者與視覺障礙使用者能透過自由軟體與電腦及網際網路互動。

工作原理

它在客戶端應用程式與各種語音合成後端之間扮演高階層的角色。系統由一個中央伺服器組成,透過管道上的簡單協定與語音模組通訊。這種架構使其能整合各種類型的語音合成,包括 C 庫、外部指令與 HTTP 服務,不論其授權條款為何。

適用對象

需要穩定且文件完整介面來管理多個語音合成引擎的無障礙軟體開發者,以及需要此功能的盲人或視覺障礙使用者。

主要特色

  • 廣泛的引擎支援:支援大量 TTS 引擎,包括 Piper、Mary、eSpeak-NG 與 Festival。
  • 彈性架構:使用伺服器與合成模組之間的管道協定,使開發新後端變得輕鬆。
  • 多語言綁定:提供 C、Python、Common Lisp 與 Guile 的 API 庫,Rust 與 Java 綁定正在開發中。
  • 專注無障礙:為 Free(b)soft 專案的一部分,旨在賦能視覺障礙使用者。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案