sveinbjornt/hear

Command line interface for the built-in speech recognition and transcription capabilities in macOS.

해결하는 문제

Apple의 macOS에는 강력한 내장 음성 인식 기능이 포함되어 있지만, 이를 접근할 수 있는 네이티브 명령줄 인터페이스(CLI)는 제공하지 않습니다. hear는 이 공백을 메우기 위해 터미널에서 직접 오디오를 변환할 수 있는 강력한 CLI 도구를 제공합니다.

작동 방식

Objective-C로 작성된 hear는 macOS 시스템 음성 인식 API에 대한 인터페이스 역할을 합니다. 라이브 마이크 입력 또는 기존 오디오 파일의 두 가지 주요 소스에서 오디오를 처리할 수 있습니다. CoreAudio와 호환되는 모든 오디오 형식을 지원하며, WAV, MP3, AIFF, AAC, CAF, ALAC 등이 포함됩니다.

대상 사용자

음성 인식 작업을 자동화하고 싶은 macOS 사용자, 터미널 기반 워크플로우에 음성-텍스트 변환을 통합하고 싶은 사용자, 또는 GUI 애플리케이션 없이 오디오 파일을 변환하고 싶은 사용자.

주요 기능

  • 이중 입력 지원: 라이브 마이크 오디오와 사전 녹음된 오디오 파일 모두 변환 가능.
  • 장치 내 처리: -d 플래그를 사용해 장치 내 음성 인식을 강제로 사용할 수 있어, 데이터를 Apple 서버에 전송하지 않고 서버 측 문자 제한을 우회할 수 있습니다.
  • 광범위한 포맷 지원: CoreAudio가 지원하는 모든 오디오 형식과 호환.
  • 네이티브 통합: macOS 전용으로 구축되어 시스템 수준의 음성 인식 기능을 활용합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트