Open-Less/openless

Hold a key, speak, release — AI-polished text appears at your cursor in any app. Open-source voice input for macOS & Windows. (按住快捷键说话,松开即得润色后的文字)

解決する課題

OpenLessは、思考を言葉にし、それをクリーンで使いやすいテキストへと変換する際の摩擦を解消するクロスプラットフォームの音声入力アプリケーションです。逐次的な書き起こしを行う標準的な音声入力ツールとは異なり、OpenLessはAIを使用して音声入力を洗練、構造化、フォーマットし、プロフェッショナルなテキストや詳細なAIプロンプトへと変換して、あらゆるアプリケーションのカーソル位置に直接挿入します。

仕組み

ユーザーがグローバルホットキーを長押しして音声を録音すると、自動音声認識(ASR)と大規模言語モデル(LLM)による推敲のパイプラインを通じて処理されます。システムはクラウドベースのASR(Volcengine, OpenAI Whisper)とローカルASR(Qwen3-ASR, Windows Foundry Whisper)の両方をサポートしています。洗練されたテキストは、ネイティブのOS挿入プロトコルを介して、文字単位でアクティブなテキストフィールドにストリーミング挿入されます。アプリケーションが直接の挿入をブロックしている場合は、クリップボードによるフォールバックが機能します。

対象ユーザー

  • AIパワーユーザー: ChatGPT、Claude、CursorなどのLLMに対して、タイピングなしで複雑で構造化されたプロンプトを音声入力したい方。
  • ライターおよび専門職: メール、仕様書、Slackメッセージなどのドラフトを作成する際、話すことを好むが、出力は文法的に正しく整理されたものを求める方。
  • 開発者: コードのコメント、コミットメッセージ、またはPRの説明を素早く記録する必要があるユーザー。

ハイライト

  • AIプロンプトモード: 断片的な発話を、コンテキストや制約を備えた構造化されたプロンプトへと再構成するために特別に設計されています。
  • スタイルパック・マーケットプレイス: ユーザーがカスタムシステムプロンプト(スタイルパック)を作成、インストール、およびホットキーで切り替えられるコミュニティ主導のシステム。
  • ストリーミング挿入: テキストが洗練されると同時にリアルタイムでカーソルに流し込むことで、体感的な遅延を軽減します。
  • BYO-Credentials: ベンダーロックインを避けるため、ASRおよびLLMプロバイダー(例:DeepSeek, OpenAI, Anthropic)の自身のクラウド認証情報の使用をサポートしています。
  • ローカルファースト: データと辞書がユーザーのローセマシンの保持されるオープンソースアーキテクチャ。