goodroot/hyprwhspr
Native speech-to-text for Linux - Fast, accurate and private system-wide dictation
What it solves
它提供一个原生、系统级的语音转文字(STT)口述工具,让 Linux 用户能够即时将语音转换为文字,并直接粘贴到任何活动应用程序的缓冲区,无需手动输入。
How it works
该工具从麦克风捕获音频,并使用多种转录后端进行处理。支持本地、内存中的模型以确保隐私和速度,同时也支持通过 REST 或 WebSocket 的云端 API(如 Gemini 与 ElevenLabs)。它专为 Wayland 会话设计,并与 systemd 用户服务集成,以在后台运行。
Who it’s for
适用于 Linux 用户(尤其是使用 Wayland 的用户),他们希望拥有快速、私密且高度可定制的口述体验,特别是拥有高端 NVIDIA GPU 以获得最佳性能的用户;同时也支持仅使用 CPU 的环境(通过 onnx-asr)。
Highlights
- Flexible Backends:支持 Cohere Transcribe、Parakeet TDT V3、Whisper 与云端 API。
- Linux Native:为 Wayland 打造,支持多种发行版,包括 Arch、Debian、Ubuntu、Fedora 与 openSUSE。
- Automatic Integration:自动将文字粘贴到任何活动缓冲区,并提供可选的音频降音功能,以在录音时降低系统音量。
- Visual Feedback:内置主题化可视化器和 OSD 覆盖层,指示录音状态。
- Hardware Optimized:针对 CUDA(NVIDIA)和 Vulkan(AMD/Intel)加速进行优化,也提供高速 CPU 选项。
- Multi-lingual:支持将非英语语音翻译成英语,并支持多语言转录。