alphacep/vosk-api

Offline speech recognition API for Android, iOS, Raspberry Pi and servers with Python, Java, C# and Node

解決する課題

インターネット接続を必要とせずに、話し言葉をテキストに変換できる、オフラインのオープンソース音声認識ツールキットを提供します。20以上の言語と方言をサポートしています。

仕組み

Voskは、大規模な語彙の連続的な文字起こしを可能にする、軽量で効率的なモデル(約50 MB)を使用しています。ゼロレイテンシの応答を実現するストリーミングAPIを提供し、話者識別や再構成可能な語彙もサポートしています。

対象者

チャットボット、スマート家電、仮想アシスタントを構築する開発者、および映画の字幕作成や講義・インタビューの文字起こしを必要とする方々。

ハイライト

  • プライバシーと信頼性のためのオフライン機能。
  • 20以上の言語と方言をサポート。
  • Raspberry Piから大規模クラスターまで、あらゆる環境で動作する軽量モデル(50 MB)。
  • Python, Java, Node.JS, C#, C++, Rust, Goを含む複数の言語のバインディングが利用可能。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト