goodroot/hyprwhspr

Native speech-to-text for Linux - Fast, accurate and private system-wide dictation

What it solves

Linux 사용자를 위해 네이티브 시스템 전역 음성-텍스트(STT) 받아쓰기 도구를 제공합니다. 음성을 즉시 텍스트로 변환하고, 수동 입력 없이 활성 애플리케이션 버퍼에 바로 붙여넣을 수 있습니다.

How it works

마이크에서 오디오를 캡처하고 다양한 전사 백엔드로 처리합니다. 프라이버시와 속도를 위해 로컬 인메모리 모델을 지원하며, REST 또는 WebSocket을 통한 클라우드 API(Gemini, ElevenLabs 등)도 사용할 수 있습니다. Wayland 세션을 위해 설계되었으며, systemd 사용자 서비스와 통합되어 백그라운드에서 동작합니다.

Who it’s for

Wayland를 사용하는 Linux 사용자, 특히 빠르고 프라이빗하며 고도로 커스터마이징 가능한 받아쓰기 경험을 원하는 사용자에게 적합합니다. 최고 성능을 위해 고성능 NVIDIA GPU를 활용할 수 있지만, onnx-asr을 통한 CPU 전용 설정도 지원합니다.

Highlights

  • Flexible Backends: Cohere Transcribe, Parakeet TDT V3, Whisper 및 클라우드 API를 지원합니다.
  • Linux Native: Wayland용으로 구축되었으며 Arch, Debian, Ubuntu, Fedora, openSUSE 등 다양한 배포판을 지원합니다.
  • Automatic Integration: 텍스트를 자동으로 활성 버퍼에 붙여넣고, 녹음 중 시스템 볼륨을 낮추는 오디오 덕킹 옵션을 제공합니다.
  • Visual Feedback: 테마가 적용된 비주얼라이저와 OSD 오버레이를 포함해 녹음 상태를 표시합니다.
  • Hardware Optimized: CUDA(NVIDIA)와 Vulkan(AMD/Intel) 가속에 최적화되어 있으며, 고속 CPU 옵션도 제공합니다.
  • Multi-lingual: 비영어 음성을 영어로 번역하고 다국어 전사를 지원합니다.