sveinbjornt/hear

Command line interface for the built-in speech recognition and transcription capabilities in macOS.

解決的問題

Apple 的 macOS 內建強大的語音辨識功能,但並未提供原生命令列介面(CLI)來存取這些功能。hear 填補了此一缺口,提供一個強大的 CLI 工具,讓使用者能直接從終端機進行音訊轉錄。

工作原理

以 Objective-C 寫成的 hear 作為 macOS 系統語音辨識 API 的介面。它可處理兩種主要音訊來源:即時麥克風輸入或現有的音訊檔案。支援所有與 CoreAudio 相容的音訊格式,包括 WAV、MP3、AIFF、AAC、CAF 和 ALAC。

適用對象

希望自動化轉錄任務、將語音轉文字功能整合至終端機導向工作流程,或不使用 GUI 應用程式即可轉錄音訊檔案的 macOS 使用者。

主要特色

  • 雙輸入支援:可轉錄即時麥克風音訊與預先錄製的音訊檔案。
  • 本機處理:包含一個旗標(-d)可強制使用本機語音辨識,避免將資料傳送至 Apple 伺服器,並避開伺服器端的字元限制。
  • 廣泛格式支援:支援 CoreAudio 支援的任何音訊格式。
  • 原生整合:專為 macOS 設計,以利用系統層級的語音辨識功能。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案