sveinbjornt/hear

Command line interface for the built-in speech recognition and transcription capabilities in macOS.

何を解決するか

AppleのmacOSには強力な組み込み音声認識機能が含まれていますが、それらにアクセスするネイティブなコマンドラインインターフェース(CLI)は提供されていません。hearはこのギャップを埋めるために、ターミナルから直接音声を変換できる信頼性の高いCLIツールを提供します。

動作方法

Objective-Cで書かれたhearは、macOSシステムの音声認識APIへのインターフェースとして機能します。ライブマイク入力または既存のオーディオファイルの2つの主な音声ソースを処理できます。CoreAudioと互換性のあるすべてのオーディオ形式に対応しており、WAV、MP3、AIFF、AAC、CAF、ALACなどが含まれます。

対象ユーザー

音声をテキストに変換するタスクを自動化したい、ターミナルベースのワークフローに音声認識を統合したい、またはGUIアプリケーションを使わずにオーディオファイルを変換したいmacOSユーザー。

特徴

  • 二重入力対応:ライブマイク音声と事前に録音されたオーディオファイルの両方を変換可能。
  • デバイス内処理-dフラグを指定することで、デバイス内での音声認識を強制的に使用でき、データをAppleのサーバーに送信せず、サーバー側の文字制限を回避できます。
  • 広範なフォーマット対応:CoreAudioがサポートするすべてのオーディオ形式に対応。
  • ネイティブ統合:macOS専用に構築され、システムレベルの音声認識機能を活用しています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト