alphacep/vosk-api
Offline speech recognition API for Android, iOS, Raspberry Pi and servers with Python, Java, C# and Node
解決する課題
インターネット接続を必要とせずに、話し言葉をテキストに変換できる、オフラインのオープンソース音声認識ツールキットを提供します。20以上の言語と方言をサポートしています。
仕組み
Voskは、大規模な語彙の連続的な文字起こしを可能にする、軽量で効率的なモデル(約50 MB)を使用しています。ゼロレイテンシの応答を実現するストリーミングAPIを提供し、話者識別や再構成可能な語彙もサポートしています。
対象者
チャットボット、スマート家電、仮想アシスタントを構築する開発者、および映画の字幕作成や講義・インタビューの文字起こしを必要とする方々。
ハイライト
- プライバシーと信頼性のためのオフライン機能。
- 20以上の言語と方言をサポート。
- Raspberry Piから大規模クラスターまで、あらゆる環境で動作する軽量モデル(50 MB)。
- Python, Java, Node.JS, C#, C++, Rust, Goを含む複数の言語のバインディングが利用可能。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト