xikhar/persona

Bringing real-time voice to life.

解决的问题

Persona 为基于语音的 AI 助手提供视觉身份。它创建一个桌面角色(头像),能够实时响应其他应用程序的音频输出,解决了 AI 对话中“有声无脸”的问题。

工作原理

Persona 是一个跨平台桌面应用程序,使用 PipeWire(Linux)、WASAPI(Windows)和 Core Audio(macOS)监听系统的音频播放流。当检测到选定语音应用的音频时,头像会执行“说话”或“空闲”动画。它还可以通过 Model Context Protocol (MCP) 服务器与 AI 代理集成,使代理能够根据对话上下文触发特定的自定义动画。

适用人群

希望为其本地 AI 语音助手或任何桌面语音体验增添生动视觉表现的用户。

主要亮点

  • 实时音频响应:根据系统音频输出自动触发说话动画。
  • 跨平台支持:支持 Windows、macOS 和 Linux 的原生监听器。
  • 可自定义头像:支持 .vrm.vrma 文件,用于自定义模型和动画。
  • MCP 集成:允许连接的 AI 代理控制头像窗口的可见性并触发特定动画。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目