goodroot/hyprwhspr

Native speech-to-text for Linux - Fast, accurate, private, and hackable system-wide dictation

何を解決するか

hyprwhspr は Linux ユーザー向けのネイティブでシステム全体にわたる音声認識(STT)ツールです。クラウド依存の音声入力の必要性を排除し、プライバシー保護された高速なローカル音声認識を提供し、OS の任意のテキストバッファに直接統合されます。

動作方法

このツールはマイクから音声をキャプチャし、さまざまな設定可能なバックエンドで処理します。オフラインでのプライバシーと高速性を実現するローカルのメモリ内モデル、またはクラウド API を選択できる柔軟性があります。CPU 最適化には ONNX-ASR を使用し、GPU による音声認識には CUDA または Vulkan 加速をサポートしています。変換後、wl-clipboardxclip などのクリップボードおよびウィンドウツールを使って、自動的にアクティブなウィンドウにテキストが貼り付けられます。

対象ユーザー

Wayland と X11 の両方のセッションで動作する、高速でプライベート、カスタマイズ可能な音声入力システムを求める Linux ユーザー(Arch、Debian、Ubuntu、Fedora、openSUSE)。

特徴

  • 複数のバックエンド対応: Cohere、Parakeet、Whisper、Qwen3-ASR、Gemini、ElevenLabs に対応。
  • プライバシー最優先: データが機械から離れることなく、完全オフラインでの変換を提供。
  • Linux ネイティブ: Linux 専用に設計され、ネイティブな AUR パッケージと systemd 統合を備えています。
  • 高性能: ONNX を通じて高価な NVIDIA GPU と CPU 動作の両方を最適化。
  • ユーザー体験: テーマ付き音声ビジュアライザー、録音中の背景ノイズ低減(オーディオダッキング)、自動貼り付け機能を搭載。
  • 多言語対応: CJK(中国語、日本語、韓国語)に強く、組み込み翻訳機能も備えています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト