goodroot/hyprwhspr

Native speech-to-text for Linux - Fast, accurate and private system-wide dictation

What it solves

它提供一个原生、系统级的语音转文字(STT)口述工具,让 Linux 用户能够即时将语音转换为文字,并直接粘贴到任何活动应用程序的缓冲区,无需手动输入。

How it works

该工具从麦克风捕获音频,并使用多种转录后端进行处理。支持本地、内存中的模型以确保隐私和速度,同时也支持通过 REST 或 WebSocket 的云端 API(如 Gemini 与 ElevenLabs)。它专为 Wayland 会话设计,并与 systemd 用户服务集成,以在后台运行。

Who it’s for

适用于 Linux 用户(尤其是使用 Wayland 的用户),他们希望拥有快速、私密且高度可定制的口述体验,特别是拥有高端 NVIDIA GPU 以获得最佳性能的用户;同时也支持仅使用 CPU 的环境(通过 onnx-asr)。

Highlights

  • Flexible Backends:支持 Cohere Transcribe、Parakeet TDT V3、Whisper 与云端 API。
  • Linux Native:为 Wayland 打造,支持多种发行版,包括 Arch、Debian、Ubuntu、Fedora 与 openSUSE。
  • Automatic Integration:自动将文字粘贴到任何活动缓冲区,并提供可选的音频降音功能,以在录音时降低系统音量。
  • Visual Feedback:内置主题化可视化器和 OSD 覆盖层,指示录音状态。
  • Hardware Optimized:针对 CUDA(NVIDIA)和 Vulkan(AMD/Intel)加速进行优化,也提供高速 CPU 选项。
  • Multi-lingual:支持将非英语语音翻译成英语,并支持多语言转录。