dictation-toolbox/dragonfly
Speech recognition framework allowing powerful Python-based scripting and extension of Dragon NaturallySpeaking (DNS), Windows Speech Recognition (WSR), Kaldi and CMU Pocket Sphinx
何を解決するか
Dragonfly は Python 用の音声認識フレームワークであり、カスタム音声コマンドの作成を簡素化します。ユーザーは Python スクリプト、マクロ、アプリケーションと音声認識エンジンを統合し、コンピュータ操作の自動化、音声によるプログラミング、または文章の音声入力を実現できます。
動作方法
Dragonfly は音声コマンドと文法オブジェクトを一等の Python オブジェクトとして扱います。CompoundRule や MappingRule などのルールを定義するフレームワークを提供し、発話されたフレーズを特定のアクション(キーストロークのシミュレーションやテキスト入力など)にマッピングできます。特定のアプリケーションコンテキスト(たとえば、Notepad ウィンドウがフォーカスされているときのみ有効)に基づいてアクティブにすることも可能です。
対象ユーザー
Python を使って複雑な音声制御の自動化やプログラミングツールを作成したい開発者やパワーユーザー。
特徴
- マルチエンジン対応: Nuance Dragon、Windows Speech Recognition (WSR)、Kaldi、CMU Pocket Sphinx をサポート。
- クロスプラットフォーム: Windows、macOS、Linux (X11) で動作。
- アクションフレームワーク: テキスト入力やキーストロークのシミュレーション用の組み込みアクションを備えています。
- コンテキスト対応:
AppContextを使って、特定のアプリケーションにコマンドを制限できます。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト