OHF-Voice/wyoming-faster-whisper
Wyoming protocol server for faster whisper speech to text system
解決する課題
このプロジェクトは、faster-whisperシステムを使用して音声認識(STT)機能を可能にする Wyoming プロトコルを実装したサーバーを提供します。特に、カスタム名(たとえば特定のスマートホームデバイス名)を誤認識するSTTモデルの問題に対処し、Home Assistantインスタンスから取得した名前をモデルにバイアスさせる機能を提供します。
動作方法
サーバーは Wyoming プロトコルと STTバックエンド(faster-whisper や qwen3-asr など)の間のブリッジとして機能します。Home Assistant API に接続して、会話で公開されているエンティティ、エリア、フロアのリストを取得できます。これらの名前は、モデルにプロンプトとして供給され、特定の用語の認識精度を向上させます。パフォーマンスを維持するために、コマンドで使用される可能性が高い名前(例:公開されたエンティティがあるエリア、次にライトやファンなどの特定のデバイスドメイン)を優先順位付けします。
対象ユーザー
Home Assistant と Wyoming プロトコルを使用し、自宅の自動化環境に特化した高精度なローカル音声認識サービスを実行したいユーザー。
特徴
- Home Assistant 統合: エンティティ名とエイリアスを自動同期し、STTモデルにバイアスをかける。
- 柔軟なバックエンド対応:
faster-whisperとqwen3-asrのバックエンドをサポート。 - ハードウェアアクセラレーション: NVIDIA GPU用のGPU対応Dockerイメージを提供し、認識速度を向上。
- 効率的なプロンプト処理: 重要度に基づく優先順位システムを実装し、モデルのトークン予算内に最も関連性の高い名前を収める。
- 展開オプション: Home Assistant Add-on、スタンドアロンDockerコンテナ、またはローカルPythonインストールで利用可能。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト