dictation-toolbox/dragonfly
Speech recognition framework allowing powerful Python-based scripting and extension of Dragon NaturallySpeaking (DNS), Windows Speech Recognition (WSR), Kaldi and CMU Pocket Sphinx
解决的问题
Dragonfly 是一个 Python 语音识别框架,可简化自定义语音命令的创建。它允许用户将语音识别引擎与 Python 脚本、宏和应用程序集成,以实现计算机操作自动化、通过语音编程或撰写文章。
工作原理
Dragonfly 将语音命令和语法对象视为一等的 Python 对象。它提供了一个框架,用于定义规则(如 CompoundRule 和 MappingRule),将语音短语映射到特定操作,例如模拟按键或输入文本。它可以根据特定的应用程序上下文激活(例如,仅当记事本窗口处于焦点时才激活)。
适用人群
希望使用 Python 创建复杂语音控制自动化和编程工具的开发者和高级用户。
主要亮点
- 多引擎支持:支持 Nuance Dragon、Windows Speech Recognition (WSR)、Kaldi 和 CMU Pocket Sphinx。
- 跨平台:可在 Windows、macOS 和 Linux (X11) 上运行。
- 动作框架:包含用于文本输入和按键模拟的内置动作。
- 上下文感知:可通过
AppContext将命令限制在特定应用程序中。
相关
- 项目
- 项目
- 项目
- 项目
- 项目