goodroot/hyprwhspr

Native speech-to-text for Linux - Fast, accurate, private, and hackable system-wide dictation

해결하는 문제

hyprwhspr는 Linux 사용자를 위한 네이티브하고 시스템 전체에 걸쳐 작동하는 음성-텍스트 변환(STT) 도구입니다. 클라우드에 의존하는 음성 입력의 필요성을 제거하고, 데이터가 기기 외부로 나가지 않는 개인 정보 보호가 가능한 고성능 로컬 변환을 제공하며, OS의 어떤 활성 텍스트 버퍼에도 직접 통합됩니다.

작동 방식

이 도구는 마이크를 통해 오디오를 캡처하고, 다양한 설정 가능한 백엔드를 사용해 처리합니다. 오프라인에서의 프라이버시와 속도를 위해 로컬 메모리 내 모델을 지원하며, 원하는 경우 클라우드 API도 사용할 수 있습니다. CPU 최적화를 위해 ONNX-ASR를 활용하고, GPU 기반 변환을 위해 CUDA 또는 Vulkan 가속을 지원합니다. 변환된 텍스트는 wl-clipboard 또는 xclip와 같은 클립보드 및 윈도우 도구를 사용해 자동으로 활성 창에 붙여넣기됩니다.

대상 사용자

Wayland 및 X11 세션 모두에서 작동하는, 빠르고 개인 정보 보호가 되며 수정 가능한 음성 입력 시스템을 원하는 Linux 사용자(Arch, Debian, Ubuntu, Fedora, openSUSE).

주요 특징

  • 다중 백엔드 지원: Cohere, Parakeet, Whisper, Qwen3-ASR, Gemini, ElevenLabs와 호환.
  • 프라이버시 우선: 데이터가 기기 외부로 나가지 않는 완전한 오프라인 변환 제공.
  • Linux 네이티브: Linux 전용으로 설계되었으며, 네이티브 AUR 패키지와 systemd 통합을 지원.
  • 고성능: ONNX를 통해 고가의 NVIDIA GPU와 CPU 전용 하드웨어 모두 최적화.
  • 사용자 경험: 테마형 음성 시각화기, 녹음 중 배경 소음 감소(오디오 덱킹), 자동 붙여넣기 기능 포함.
  • 다국어 지원: CJK(중국어, 일본어, 한국어)에 강력한 지원과 내장 번역 기능 제공.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트