dictation-toolbox/dragonfly
Speech recognition framework allowing powerful Python-based scripting and extension of Dragon NaturallySpeaking (DNS), Windows Speech Recognition (WSR), Kaldi and CMU Pocket Sphinx
해결하는 문제
Dragonfly는 Python용 음성 인식 프레임워크로, 사용자가 사용자 정의 음성 명령을 쉽게 만들 수 있도록 도와줍니다. Python 스크립트, 매크로, 애플리케이션과 음성 인식 엔진을 통합하여 컴퓨터 작업을 자동화하거나 음성으로 프로그래밍하거나 논문을 음성 입력할 수 있습니다.
작동 방식
Dragonfly는 음성 명령과 문법 객체를 일급 Python 객체로 취급합니다. CompoundRule 및 MappingRule와 같은 규칙을 정의하는 프레임워크를 제공하여, 말한 구문을 특정 작업(예: 키 입력 시뮬레이션 또는 텍스트 입력)으로 매핑할 수 있습니다. 특정 애플리케이션 컨텍스트(예: Notepad 창이 포커스된 경우에만 활성화)에 따라 활성화될 수 있습니다.
대상 사용자
Python을 사용하여 복잡한 음성 제어 자동화 및 프로그래밍 도구를 만들고자 하는 개발자 및 고급 사용자.
주요 기능
- 다중 엔진 지원: Nuance Dragon, Windows Speech Recognition (WSR), Kaldi, CMU Pocket Sphinx를 지원합니다.
- 크로스 플랫폼: Windows, macOS, Linux (X11)에서 작동합니다.
- 액션 프레임워크: 텍스트 입력 및 키 입력 시뮬레이션을 위한 내장 액션이 포함되어 있습니다.
- 컨텍스트 인식:
AppContext를 통해 특정 애플리케이션에 명령을 제한할 수 있습니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트