xikhar/persona

Bringing real-time voice to life.

何を解決するか

Persona は音声ベースのAIアシスタントに視覚的アイデンティティを提供します。他のアプリケーションからの音声出力にリアルタイムで反応するデスクトップキャラクター(アバター)を生成し、AI会話中に「声だけの存在」になる問題を解決します。

動作方法

Persona はクロスプラットフォームのデスクトップアプリで、LinuxではPipeWire、WindowsではWASAPI、macOSではCore Audioを使用してシステムの音声再生ストリームをリッスンします。選択された音声アプリからの音声を検出すると、アバターは「話している」または「アイドル」アニメーションを実行します。また、Model Context Protocol (MCP) サーバーを介してAIエージェントと統合可能で、会話の文脈に基づいて特定のカスタムアニメーションをトリガーできます。

対象ユーザー

ローカルのAI音声アシスタントや任意のデスクトップ音声体験に表現力のある視覚的存在を追加したいユーザー向けです。

特徴

  • リアルタイム音声反応: システムの音声出力に基づいて自動的に話すアニメーションをトリガーします。
  • クロスプラットフォーム対応: Windows、macOS、Linux用のネイティブリスナーを備えています。
  • カスタマイズ可能なアバター: カスタムモデルとアニメーションに対応する .vrm および .vrma ファイルをサポートしています。
  • MCP統合: 接続されたAIエージェントがアバターのウィンドウの可視性を制御し、特定のアニメーションをトリガーできるようにします。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト