xikhar/persona
Bringing real-time voice to life.
해결하는 문제
Persona는 음성 기반 AI 어시스턴트에 시각적 정체성을 제공합니다. 다른 애플리케이션의 오디오 출력에 실시간으로 반응하는 데스크탑 캐릭터(아바타)를 생성하여, AI 대화 중에 "목소리만 있고 얼굴이 없는" 상태를 해결합니다.
작동 방식
Persona는 크로스플랫폼 데스크탑 애플리케이션으로, Linux에서는 PipeWire, Windows에서는 WASAPI, macOS에서는 Core Audio를 사용하여 시스템 오디오 재생 스트림을 리슨합니다. 선택된 음성 앱에서 오디오를 감지하면, 아바타는 "발화 중" 또는 "대기 중" 애니메이션을 수행합니다. 또한 Model Context Protocol (MCP) 서버를 통해 AI 에이전트와 통합 가능하여, 대화 맥락에 따라 특정 사용자 정의 애니메이션을 트리거할 수 있습니다.
대상 사용자
로컬 AI 음성 어시스턴트나 어떤 데스크탑 음성 경험에도 표현력 있는 시각적 존재를 추가하고 싶은 사용자에게 적합합니다.
주요 기능
- 실시간 오디오 반응: 시스템 오디오 출력에 따라 자동으로 발화 애니메이션을 트리거합니다.
- 크로스플랫폼 지원: Windows, macOS, Linux용 네이티브 리스너를 제공합니다.
- 사용자 정의 아바타: 사용자 정의 모델과 애니메이션을 지원하는
.vrm및.vrma파일을 지원합니다. - MCP 통합: 연결된 AI 에이전트가 아바타의 창 가시성을 제어하고 특정 애니메이션을 트리거할 수 있습니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트