xikhar/persona

Bringing real-time voice to life.

解決的問題

Persona 為基於語音的 AI 助手提供視覺身分。它建立一個桌面角色(頭像),能即時回應其他應用程式的音訊輸出,解決 AI 對話中「有聲無臉」的問題。

工作原理

Persona 是一個跨平台桌面應用程式,使用 PipeWire(Linux)、WASAPI(Windows)和 Core Audio(macOS)監聽系統的音訊播放串流。當偵測到選定語音應用的音訊時,頭像會執行「說話」或「閒置」動畫。它也可以透過 Model Context Protocol (MCP) 伺服器與 AI 代理整合,讓代理根據對話情境觸發特定的自訂動畫。

適用對象

希望為其本地 AI 語音助手或任何桌面語音體驗增添生動視覺表現的使用者。

主要亮點

  • 即時音訊回應:根據系統音訊輸出自動觸發說話動畫。
  • 跨平台支援:支援 Windows、macOS 和 Linux 的原生監聽器。
  • 可自訂頭像:支援 .vrm.vrma 檔案,用於自訂模型與動畫。
  • MCP 整合:允許連接的 AI 代理控制頭像視窗的可見性並觸發特定動畫。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案