xikhar/persona
Bringing real-time voice to life.
解决的问题
Persona 为基于语音的 AI 助手提供视觉身份。它创建一个桌面角色(头像),能够实时响应其他应用程序的音频输出,解决了 AI 对话中“有声无脸”的问题。
工作原理
Persona 是一个跨平台桌面应用程序,使用 PipeWire(Linux)、WASAPI(Windows)和 Core Audio(macOS)监听系统的音频播放流。当检测到选定语音应用的音频时,头像会执行“说话”或“空闲”动画。它还可以通过 Model Context Protocol (MCP) 服务器与 AI 代理集成,使代理能够根据对话上下文触发特定的自定义动画。
适用人群
希望为其本地 AI 语音助手或任何桌面语音体验增添生动视觉表现的用户。
主要亮点
- 实时音频响应:根据系统音频输出自动触发说话动画。
- 跨平台支持:支持 Windows、macOS 和 Linux 的原生监听器。
- 可自定义头像:支持
.vrm和.vrma文件,用于自定义模型和动画。 - MCP 集成:允许连接的 AI 代理控制头像窗口的可见性并触发特定动画。
相关
- 项目
- 项目
- 项目
- 项目
- 项目