goodroot/hyprwhspr
Native speech-to-text for Linux - Fast, accurate, private, and hackable system-wide dictation
解决的问题
hyprwhspr 为 Linux 用户提供了一个原生的、系统级的语音转文本(STT)语音输入工具。它消除了对云依赖语音输入的需求,提供高性能的本地转录,确保数据私密、快速,并可直接集成到操作系统中的任何活动文本缓冲区中。
工作原理
该工具通过麦克风捕获音频,并使用多种可配置的后端进行处理。它支持本地内存模型以实现离线隐私和速度,也支持云 API 供偏好用户选择。它利用 ONNX-ASR 实现 CPU 优化,并支持 CUDA 或 Vulkan 加速以实现 GPU 驱动的转录。转录完成后,文本会通过 wl-clipboard 或 xclip 等剪贴板和窗口工具自动粘贴到当前活动窗口中。
适用人群
希望在 Wayland 和 X11 会话中均能使用、快速、私密且可自定义的语音输入系统,且运行在 Arch、Debian、Ubuntu、Fedora、openSUSE 等 Linux 发行版上的用户。
主要亮点
- 多后端支持:兼容 Cohere、Parakeet、Whisper、Qwen3-ASR、Gemini 和 ElevenLabs。
- 隐私优先:提供完全离线转录,数据永不离开设备。
- 原生 Linux:专为 Linux 设计,提供原生 AUR 包和 systemd 集成。
- 高性能:通过 ONNX 优化,适用于高端 NVIDIA GPU 和仅 CPU 硬件。
- 用户体验:包含主题化语音可视化器、录音时自动降低背景音(音频静音)、自动粘贴功能。
- 多语言支持:对 CJK(中文、日文、韩文)支持良好,并具备内置翻译功能。
相关
- 项目
- 项目
- 项目
- 项目
- 项目