jamsch/expo-speech-recognition

Speech Recognition for React Native Expo projects

何を解決するか

expo-speech-recognition は、React Native プロジェクトで音声認識機能を実装するための統一 API を提供します。iOS、Android、Web の間で分散しているネイティブ音声認識 API の問題を解決し、1 つのコードベースで 3 つのプラットフォームすべてで動作するようにします。

動作方法

このライブラリは、各プラットフォームのネイティブ音声認識サービスをラップする役割を果たします:

  • iOS: SFSpeechRecognizer を使用。
  • Android: SpeechRecognizer を使用。
  • Web: SpeechRecognition API を使用。

useSpeechRecognitionEvent のようなフックや、ExpoSpeechRecognitionModule という直接モジュール API を提供し、音声認識セッションの開始・停止・管理を可能にします。権限の処理、イベント駆動型の結果(一時的および最終的)、オンデバイス認識やオーディオセッションカテゴリなどのプラットフォーム固有の設定をすべて処理します。

対象ユーザー

プラットフォーム固有のネイティブコードを書かずに、モバイルおよび Web アプリケーションに音声入力や音声認識サービスを統合したい React Native および Expo 開発者。

特徴

  • クロスプラットフォーム対応: iOS、Android、Web 用の統一インターフェース。
  • 柔軟な変換: 実時間(一時的)結果と最終的な変換の両方をサポート。
  • オーディオの永続化: Android 13+ および iOS でローカルファイルにオーディオ録音を保存可能。
  • ファイルベースの変換: ローカル URI から既存のオーディオファイルを変換可能。
  • 高度な制御: ボリュームメーター、言語検出(Android 14+)、ネットワーク経由の音声送信を防ぐためにオンデバイス認識を強制する機能を含む。
  • カスタマイズ: 特定のアプリ関連用語の認識精度を向上させるために、コンテキスト文字列を提供可能。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト