sveinbjornt/hear
Command line interface for the built-in speech recognition and transcription capabilities in macOS.
解決的問題
Apple 的 macOS 內建強大的語音辨識功能,但並未提供原生命令列介面(CLI)來存取這些功能。hear 填補了此一缺口,提供一個強大的 CLI 工具,讓使用者能直接從終端機進行音訊轉錄。
工作原理
以 Objective-C 寫成的 hear 作為 macOS 系統語音辨識 API 的介面。它可處理兩種主要音訊來源:即時麥克風輸入或現有的音訊檔案。支援所有與 CoreAudio 相容的音訊格式,包括 WAV、MP3、AIFF、AAC、CAF 和 ALAC。
適用對象
希望自動化轉錄任務、將語音轉文字功能整合至終端機導向工作流程,或不使用 GUI 應用程式即可轉錄音訊檔案的 macOS 使用者。
主要特色
- 雙輸入支援:可轉錄即時麥克風音訊與預先錄製的音訊檔案。
- 本機處理:包含一個旗標(
-d)可強制使用本機語音辨識,避免將資料傳送至 Apple 伺服器,並避開伺服器端的字元限制。 - 廣泛格式支援:支援 CoreAudio 支援的任何音訊格式。
- 原生整合:專為 macOS 設計,以利用系統層級的語音辨識功能。
相關
- 專案
- 專案
- 專案
- 專案
- 專案