sveinbjornt/hear
Command line interface for the built-in speech recognition and transcription capabilities in macOS.
何を解決するか
AppleのmacOSには強力な組み込み音声認識機能が含まれていますが、それらにアクセスするネイティブなコマンドラインインターフェース(CLI)は提供されていません。hearはこのギャップを埋めるために、ターミナルから直接音声を変換できる信頼性の高いCLIツールを提供します。
動作方法
Objective-Cで書かれたhearは、macOSシステムの音声認識APIへのインターフェースとして機能します。ライブマイク入力または既存のオーディオファイルの2つの主な音声ソースを処理できます。CoreAudioと互換性のあるすべてのオーディオ形式に対応しており、WAV、MP3、AIFF、AAC、CAF、ALACなどが含まれます。
対象ユーザー
音声をテキストに変換するタスクを自動化したい、ターミナルベースのワークフローに音声認識を統合したい、またはGUIアプリケーションを使わずにオーディオファイルを変換したいmacOSユーザー。
特徴
- 二重入力対応:ライブマイク音声と事前に録音されたオーディオファイルの両方を変換可能。
- デバイス内処理:
-dフラグを指定することで、デバイス内での音声認識を強制的に使用でき、データをAppleのサーバーに送信せず、サーバー側の文字制限を回避できます。 - 広範なフォーマット対応:CoreAudioがサポートするすべてのオーディオ形式に対応。
- ネイティブ統合:macOS専用に構築され、システムレベルの音声認識機能を活用しています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト