goodroot/hyprwhspr
Native speech-to-text for Linux - Fast, accurate, private, and hackable system-wide dictation
何を解決するか
hyprwhspr は Linux ユーザー向けのネイティブでシステム全体にわたる音声認識(STT)ツールです。クラウド依存の音声入力の必要性を排除し、プライバシー保護された高速なローカル音声認識を提供し、OS の任意のテキストバッファに直接統合されます。
動作方法
このツールはマイクから音声をキャプチャし、さまざまな設定可能なバックエンドで処理します。オフラインでのプライバシーと高速性を実現するローカルのメモリ内モデル、またはクラウド API を選択できる柔軟性があります。CPU 最適化には ONNX-ASR を使用し、GPU による音声認識には CUDA または Vulkan 加速をサポートしています。変換後、wl-clipboard や xclip などのクリップボードおよびウィンドウツールを使って、自動的にアクティブなウィンドウにテキストが貼り付けられます。
対象ユーザー
Wayland と X11 の両方のセッションで動作する、高速でプライベート、カスタマイズ可能な音声入力システムを求める Linux ユーザー(Arch、Debian、Ubuntu、Fedora、openSUSE)。
特徴
- 複数のバックエンド対応: Cohere、Parakeet、Whisper、Qwen3-ASR、Gemini、ElevenLabs に対応。
- プライバシー最優先: データが機械から離れることなく、完全オフラインでの変換を提供。
- Linux ネイティブ: Linux 専用に設計され、ネイティブな AUR パッケージと systemd 統合を備えています。
- 高性能: ONNX を通じて高価な NVIDIA GPU と CPU 動作の両方を最適化。
- ユーザー体験: テーマ付き音声ビジュアライザー、録音中の背景ノイズ低減(オーディオダッキング)、自動貼り付け機能を搭載。
- 多言語対応: CJK(中国語、日本語、韓国語)に強く、組み込み翻訳機能も備えています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト