dictation-toolbox/dragonfly

Speech recognition framework allowing powerful Python-based scripting and extension of Dragon NaturallySpeaking (DNS), Windows Speech Recognition (WSR), Kaldi and CMU Pocket Sphinx

解決的問題

Dragonfly 是一個 Python 語音辨識框架,可簡化自訂語音指令的建立。它允許使用者將語音辨識引擎與 Python 腳本、巨集和應用程式整合,以自動化電腦操作、透過語音程式設計,或撰寫文章。

工作原理

Dragonfly 將語音指令和語法物件視為一等的 Python 物件。它提供一個框架,用於定義規則(如 CompoundRuleMappingRule),將 spoken phrases(發音短語)對應到特定動作,例如模擬鍵盤按鍵或輸入文字。它可根據特定應用程式環境激活(例如,僅當記事本視窗取得焦點時才啟用)。

適用對象

希望使用 Python 建立複雜語音控制自動化與程式設計工具的開發者與高階使用者。

主要特色

  • 多引擎支援:支援 Nuance Dragon、Windows Speech Recognition (WSR)、Kaldi 與 CMU Pocket Sphinx。
  • 跨平台:可在 Windows、macOS 與 Linux (X11) 上運作。
  • 動作框架:內建用於文字輸入與鍵盤模擬的動作。
  • 上下文感知:可透過 AppContext 將指令限制於特定應用程式。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案