tover0314-w/opentypeless
Open-source AI voice typing for macOS, Windows, and Linux. Press a hotkey, speak naturally, get polished text in any app.
它解决了什么问题
OpenTypeless 是一款跨平台的桌面应用程序,可将语音输入转换为高质量文本。它通过添加由 AI 驱动的「润色」层,解决了标准语音输入工具的局限性,使用户能够自然地说话,而 AI 会自动重写文本,使其符合用户正在使用的特定应用程序的语气和结构(例如邮件、聊天或代码编辑器)。
它如何工作
用户通过全局快捷键触发该应用以捕获音频。系统随后遵循一个特定的处理流程:
- 转录:音频被发送到选定的语音转文本(STT)服务提供商(如 Groq、Deepgram 或 OpenAI Whisper)。
- 上下文分析:应用在本地检测当前活动的应用程序,以确定合适的写作风格。
- AI 润色:如果启用,原始转录文本会连同应用特定的元数据一起发送到大型语言模型(LLM)中,进行重写或翻译。
- 输出:最终文本将直接输入到当前活动的应用程序中,或复制到剪贴板。
适合谁使用
专为 macOS、Windows 和 Linux 上的高级用户设计,他们希望加快在各种应用程序中的写作流程,也适合那些更倾向于使用语音问答而非传统聊天界面的用户。
主要特性
- 应用感知写作:根据检测到的当前活动应用,自动调整语气和结构。
- 随时提问:支持一次性的语音问答流程,以浮动便签形式提供简洁答案,无需依赖聊天应用。
- 选中文本编辑:允许用户在任意应用中选中文本,并通过语音指令进行重写、摘要或翻译。
- 灵活的提供商支持:支持「自带密钥」(BYOK)模式,兼容多种 STT 和 LLM 服务提供商(包括 Ollama 用于本地托管)或托管云选项。
- 自定义词典:本地化纠错规则和术语管理,用于修复反复出现的转录错误。
相关
- 项目
- 项目
- 项目
- 项目
- 项目