sveinbjornt/hear

Command line interface for the built-in speech recognition and transcription capabilities in macOS.

解决的问题

Apple 的 macOS 包含强大的内置语音识别功能,但并未提供原生命令行接口(CLI)来访问这些功能。hear 填补了这一空白,提供了一个强大的 CLI 工具,允许用户直接从终端进行音频转录。

工作原理

使用 Objective-C 编写的 hear 作为 macOS 系统语音识别 API 的接口。它可以处理两种主要音频源:实时麦克风输入或现有的音频文件。支持所有与 CoreAudio 兼容的音频格式,包括 WAV、MP3、AIFF、AAC、CAF 和 ALAC。

适用人群

希望自动化转录任务、将语音转文字功能集成到基于终端的工作流中,或无需使用 GUI 应用程序即可转录音频文件的 macOS 用户。

主要特性

  • 双输入支持:可转录实时麦克风音频和预录制的音频文件。
  • 本地处理:包含一个标志(-d)可强制使用本地语音识别,避免将数据发送到 Apple 服务器,并绕过服务器端的字符限制。
  • 广泛格式支持:支持 CoreAudio 支持的任何音频格式。
  • 原生集成:专为 macOS 构建,以利用系统级语音识别功能。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目