dictation-toolbox/dragonfly

Speech recognition framework allowing powerful Python-based scripting and extension of Dragon NaturallySpeaking (DNS), Windows Speech Recognition (WSR), Kaldi and CMU Pocket Sphinx

解决的问题

Dragonfly 是一个 Python 语音识别框架,可简化自定义语音命令的创建。它允许用户将语音识别引擎与 Python 脚本、宏和应用程序集成,以实现计算机操作自动化、通过语音编程或撰写文章。

工作原理

Dragonfly 将语音命令和语法对象视为一等的 Python 对象。它提供了一个框架,用于定义规则(如 CompoundRuleMappingRule),将语音短语映射到特定操作,例如模拟按键或输入文本。它可以根据特定的应用程序上下文激活(例如,仅当记事本窗口处于焦点时才激活)。

适用人群

希望使用 Python 创建复杂语音控制自动化和编程工具的开发者和高级用户。

主要亮点

  • 多引擎支持:支持 Nuance Dragon、Windows Speech Recognition (WSR)、Kaldi 和 CMU Pocket Sphinx。
  • 跨平台:可在 Windows、macOS 和 Linux (X11) 上运行。
  • 动作框架:包含用于文本输入和按键模拟的内置动作。
  • 上下文感知:可通过 AppContext 将命令限制在特定应用程序中。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目