algolia/voice-overlay-ios

🗣 An overlay that gets your user’s voice permission and input as text in a customizable UI

What it solves

このライブラリは、iOS アプリに音声からテキストへの変換を行うための、洗練された、すぐに使えるユーザーインターフェース・オーバーレイを提供します。マイクや音声認識の権限リクエスト、権限が拒否された場合の設定画面への誘導など、ユーザーエクスペリエンスにおける複雑な部分を管理することで、音声入力の実装をプロセスを簡らえます。

How it works

このプロジェクトは、Apple のネイティブ SFSpeechRecognizer を使用して、実際の音声からテキストへの変換を行います。この機能を VoiceOverlayController にラップし、録音状態の管理、視覚的なフィードバック(波紋エフェクトなど)を提供し、文字起こしされたテキストをハンドラーまたはデリゲートを通じて返します。

Who it’s for

カスタム UI や権限管理のロジックを構築することなく、アプリに音声検索や音声入力機能を追加したい iOS 開発者向けです。

Highlights

  • Permission Management: マイクと音声認識の権限リクエストを自動的に処理し、権限が不足している場合はシステム設定へユーザーを誘導します。

  • Customizable UI: 開発者が、異なる画面(例:権限画面、入力画面)の色、タイトル、レイアウト定数を変更できるようにします。

  • Flexible Recording: 自動開始および自動停止(サイレンス・タイムアウトに基づく)または手動トリガーモードをサポートします。

  • Custom Speech Controller: 開発者が Recordable プロトコルを実装することで、独自のカスタム音声認識ロジックを使用できます。

  • Result Screen: 録音終了後に処理結果の画面を表示するベータ版機能が含まれています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト