dictation-toolbox/dragonfly
Speech recognition framework allowing powerful Python-based scripting and extension of Dragon NaturallySpeaking (DNS), Windows Speech Recognition (WSR), Kaldi and CMU Pocket Sphinx
解決的問題
Dragonfly 是一個 Python 語音辨識框架,可簡化自訂語音指令的建立。它允許使用者將語音辨識引擎與 Python 腳本、巨集和應用程式整合,以自動化電腦操作、透過語音程式設計,或撰寫文章。
工作原理
Dragonfly 將語音指令和語法物件視為一等的 Python 物件。它提供一個框架,用於定義規則(如 CompoundRule 和 MappingRule),將 spoken phrases(發音短語)對應到特定動作,例如模擬鍵盤按鍵或輸入文字。它可根據特定應用程式環境激活(例如,僅當記事本視窗取得焦點時才啟用)。
適用對象
希望使用 Python 建立複雜語音控制自動化與程式設計工具的開發者與高階使用者。
主要特色
- 多引擎支援:支援 Nuance Dragon、Windows Speech Recognition (WSR)、Kaldi 與 CMU Pocket Sphinx。
- 跨平台:可在 Windows、macOS 與 Linux (X11) 上運作。
- 動作框架:內建用於文字輸入與鍵盤模擬的動作。
- 上下文感知:可透過
AppContext將指令限制於特定應用程式。
相關
- 專案
- 專案
- 專案
- 專案
- 專案