xikhar/persona
Bringing real-time voice to life.
解決的問題
Persona 為基於語音的 AI 助手提供視覺身分。它建立一個桌面角色(頭像),能即時回應其他應用程式的音訊輸出,解決 AI 對話中「有聲無臉」的問題。
工作原理
Persona 是一個跨平台桌面應用程式,使用 PipeWire(Linux)、WASAPI(Windows)和 Core Audio(macOS)監聽系統的音訊播放串流。當偵測到選定語音應用的音訊時,頭像會執行「說話」或「閒置」動畫。它也可以透過 Model Context Protocol (MCP) 伺服器與 AI 代理整合,讓代理根據對話情境觸發特定的自訂動畫。
適用對象
希望為其本地 AI 語音助手或任何桌面語音體驗增添生動視覺表現的使用者。
主要亮點
- 即時音訊回應:根據系統音訊輸出自動觸發說話動畫。
- 跨平台支援:支援 Windows、macOS 和 Linux 的原生監聽器。
- 可自訂頭像:支援
.vrm和.vrma檔案,用於自訂模型與動畫。 - MCP 整合:允許連接的 AI 代理控制頭像視窗的可見性並觸發特定動畫。
相關
- 專案
- 專案
- 專案
- 專案
- 專案