karansinghgit/speaktype

100% offline, open-source, Voice Dictation app on any OS

何を解決するか

SpeakType はプライバシーを最優先にした音声認識ツールで、ユーザーがコンピュータ上の任意のアプリケーションに音声でテキストを入力する際に、音声データを外部サーバーに送信する必要がありません。有料サブスクリプションやインターネット接続を必要とせず、クラウドベースの音声入力アプリの無料でローカル第一の代替手段を提供します。

動作方法

このアプリケーションは macOS、Windows、Linux でローカルで実行されます。ユーザーは OpenAI Whisper や NVIDIA Parakeet などの音声モデルを直接自分のマシンにダウンロードします。カスタマイズ可能なショートカットキーを押しながら話すと、アプリはリアルタイムで音声を認識し、現在アクティブなテキストフィールドのカーソル位置に直接テキストを挿入します。

対象ユーザー

すべてのデスクトップアプリケーションで、高速で無料かつプライバシー保護された音声入力が必要なユーザー。特にオフライン動作を好む人や、データの完全なコントロールを求める人におすすめです。

特徴

  • 100% ローカル処理: すべての音声認識処理がユーザーのコンピュータ上で行われ、プライバシーとオフライン利用が保証されます。
  • 広範な互換性: macOS、Windows、Linux ですべてのアプリケーションと互換性があります。
  • 複数モデル対応: Parakeet(高速)や Whisper(99言語対応)など、さまざまなモデルを選択できます。
  • カスタマイズ可能な辞書: 特定の名前や用語を学習させることで、認識精度を向上できます。
  • 音声認識履歴: ディクテーションの履歴をローカルに保存し、簡単にコピー・再生できます。
  • 自動クリーンアップ: 「うーん」などのフィラー語を自動的に削除します。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト