goodroot/hyprwhspr
Native speech-to-text for Linux - Fast, accurate, private, and hackable system-wide dictation
解決的問題
hyprwhspr 為 Linux 使用者提供原生且系統級的語音轉文字(STT)語音輸入工具。它消除了對雲端依賴語音輸入的需求,提供高效率的本地轉錄,確保資料私密、快速,並可直接整合至作業系統中的任何活躍文字緩衝區。
工作原理
此工具透過麥克風捕獲音訊,並使用多種可設定的後端進行處理。支援本地記憶體模型以實現離線隱私與速度,也支援雲端 API 供偏好使用者選擇。利用 ONNX-ASR 實現 CPU 優化,並支援 CUDA 或 Vulkan 加速以實現 GPU 驅動的轉錄。轉錄完成後,文字會透過 wl-clipboard 或 xclip 等剪貼簿與視窗工具自動貼到目前活躍的視窗中。
適用對象
希望在 Wayland 與 X11 會話中皆能使用、快速、私密且可客製化的語音輸入系統,且運行於 Arch、Debian、Ubuntu、Fedora、openSUSE 等 Linux 發行版上的使用者。
主要特色
- 多後端支援:相容 Cohere、Parakeet、Whisper、Qwen3-ASR、Gemini 與 ElevenLabs。
- 隱私優先:提供完全離線轉錄,資料永不離開裝置。
- 原生 Linux:專為 Linux 設計,提供原生 AUR 套件與 systemd 整合。
- 高效率:透過 ONNX 優化,適用於高階 NVIDIA GPU 與僅 CPU 硬體。
- 使用者體驗:包含主題式語音視覺化器、錄音時自動降低背景音(音訊壓低)、自動貼上功能。
- 多語言支援:對 CJK(中文、日文、韓文)支援良好,並具備內建翻譯功能。
相關
- 專案
- 專案
- 專案
- 專案
- 專案