tover0314-w/opentypeless

Open-source AI voice typing for macOS, Windows, and Linux. Press a hotkey, speak naturally, get polished text in any app.

它解決的問題

OpenTypeless 是一款跨平台的桌面應用程式,可將語音輸入轉換為高品質的文字。它解決了標準語音輸入工具的限制,透過加入由 AI 驅動的「潤飾」層,讓使用者能自然地說話,並由 AI 將文字重寫以符合使用者正在使用的特定應用程式(例如電子郵件、聊天或程式碼編輯器)的語氣與結構。

如何運作

使用者透過全域快捷鍵觸發應用程式以捕捉音訊。系統隨後遵循特定流程:

  1. 轉錄:音訊會傳送至所選的語音轉文字(STT)服務提供者(如 Groq、Deepgram 或 OpenAI Whisper)。
  2. 上下文分析:應用程式會在本地偵測目前活躍的應用程式,以判斷適當的寫作風格。
  3. AI 潤飾:若啟用,原始轉錄內容會連同應用程式特定的元資料一起傳送至大型語言模型(LLM),以進行重寫或翻譯。
  4. 輸出:最終文字會直接輸入至活躍的應用程式,或複製到剪貼簿。

適用對象

專為 macOS、Windows 和 Linux 上的進階使用者設計,適合希望加快跨多個應用程式撰寫流程的人,以及偏好以語音為首的問答方式,而非傳統聊天介面的使用者。

主要特色

  • 應用程式感知撰寫:根據偵測到的活躍應用程式自動調整語氣與結構。
  • 隨意提問:一次語音問答流程,提供簡潔的答案於浮動筆記中,無需使用聊天應用程式。
  • 選取文字編輯:允許使用者在任何應用程式中選取文字,並以語音指令重寫、摘要或翻譯該內容。
  • 彈性提供者支援:支援「自行帶入金鑰」(BYOK)模式,適用於多種 STT 與 LLM 提供者(包括 Ollama 用於本地主機)或管理式雲端選項。
  • 自訂詞典:本地修正規則與專有名詞管理,以修正常見的轉錄錯誤。

這是一個真正能理解上下文的語音輸入工具——@jamesknelson

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案