tover0314-w/opentypeless

Open-source AI voice typing for macOS, Windows, and Linux. Press a hotkey, speak naturally, get polished text in any app.

它解决了什么问题

OpenTypeless 是一款跨平台的桌面应用程序,可将语音输入转换为高质量文本。它通过添加由 AI 驱动的「润色」层,解决了标准语音输入工具的局限性,使用户能够自然地说话,而 AI 会自动重写文本,使其符合用户正在使用的特定应用程序的语气和结构(例如邮件、聊天或代码编辑器)。

它如何工作

用户通过全局快捷键触发该应用以捕获音频。系统随后遵循一个特定的处理流程:

  1. 转录:音频被发送到选定的语音转文本(STT)服务提供商(如 Groq、Deepgram 或 OpenAI Whisper)。
  2. 上下文分析:应用在本地检测当前活动的应用程序,以确定合适的写作风格。
  3. AI 润色:如果启用,原始转录文本会连同应用特定的元数据一起发送到大型语言模型(LLM)中,进行重写或翻译。
  4. 输出:最终文本将直接输入到当前活动的应用程序中,或复制到剪贴板。

适合谁使用

专为 macOS、Windows 和 Linux 上的高级用户设计,他们希望加快在各种应用程序中的写作流程,也适合那些更倾向于使用语音问答而非传统聊天界面的用户。

主要特性

  • 应用感知写作:根据检测到的当前活动应用,自动调整语气和结构。
  • 随时提问:支持一次性的语音问答流程,以浮动便签形式提供简洁答案,无需依赖聊天应用。
  • 选中文本编辑:允许用户在任意应用中选中文本,并通过语音指令进行重写、摘要或翻译。
  • 灵活的提供商支持:支持「自带密钥」(BYOK)模式,兼容多种 STT 和 LLM 服务提供商(包括 Ollama 用于本地托管)或托管云选项。
  • 自定义词典:本地化纠错规则和术语管理,用于修复反复出现的转录错误。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目