goodroot/hyprwhspr

Native speech-to-text for Linux - Fast, accurate, private, and hackable system-wide dictation

解决的问题

hyprwhspr 为 Linux 用户提供了一个原生的、系统级的语音转文本(STT)语音输入工具。它消除了对云依赖语音输入的需求,提供高性能的本地转录,确保数据私密、快速,并可直接集成到操作系统中的任何活动文本缓冲区中。

工作原理

该工具通过麦克风捕获音频,并使用多种可配置的后端进行处理。它支持本地内存模型以实现离线隐私和速度,也支持云 API 供偏好用户选择。它利用 ONNX-ASR 实现 CPU 优化,并支持 CUDA 或 Vulkan 加速以实现 GPU 驱动的转录。转录完成后,文本会通过 wl-clipboardxclip 等剪贴板和窗口工具自动粘贴到当前活动窗口中。

适用人群

希望在 Wayland 和 X11 会话中均能使用、快速、私密且可自定义的语音输入系统,且运行在 Arch、Debian、Ubuntu、Fedora、openSUSE 等 Linux 发行版上的用户。

主要亮点

  • 多后端支持:兼容 Cohere、Parakeet、Whisper、Qwen3-ASR、Gemini 和 ElevenLabs。
  • 隐私优先:提供完全离线转录,数据永不离开设备。
  • 原生 Linux:专为 Linux 设计,提供原生 AUR 包和 systemd 集成。
  • 高性能:通过 ONNX 优化,适用于高端 NVIDIA GPU 和仅 CPU 硬件。
  • 用户体验:包含主题化语音可视化器、录音时自动降低背景音(音频静音)、自动粘贴功能。
  • 多语言支持:对 CJK(中文、日文、韩文)支持良好,并具备内置翻译功能。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目