pollen-robotics/reachy_mini_conversation_app
Talk with Reachy Mini!
何を解決するか
このプロジェクトは、リアルタイム音声、視覚、および編成された動きを統合した、Reachy Miniロボット用の会話型インターフェースを提供します。高レベルのAI推論(LLM)と物理的ロボットハードウェアの間のギャップを埋め、自然言語の会話に基づいて感情を表現したり、ダンスをしたり、タスクを実行したりできるようにします。
動作方法
このアプリは、ユーザーをリアルタイムAIバックエンド(Hugging Face経由)とロボットのハードウェアに接続します。音声反応型の動き(たとえば、ゆらゆらする動き)とキューイングされた主要なアクション(ダンスや特定のポーズなど)を組み合わせるレイヤードモーションシステムを使用しています。
ツールベースのアーキテクチャを採用しており、AIアシスタントが特定の関数をトリガーできます:
- ローカルツール:ロボットのハードウェアを制御するPythonモジュール(例:頭部の移動、カメラフレームのキャプチャ)。
- リモートツール:MCP互換のHugging Face Spacesで、外部データを提供します(例:ウェブ検索、天気、時刻)。
ユーザーは「プロフィール」(個性)を定義でき、特定のシステムプロンプトと有効化されたツールのセットを含めることで、ロボットの振る舞いを変更できます。
対象ユーザー
- Reachy Miniハードウェアを使用するロボット所有者および開発者。
- 身体化された知能と人間-ロボットインタラクションに興味を持つAI研究者。
- LLMベースのツールコールを使ってカスタムロボット行動を構築・テストしたい開発者。
特徴
- リアルタイムインタラクション:低レイテンシの音声会話と視覚処理。
- 個性システム:独自の指示とツールアクセスを持つカスタマイズ可能なプロフィール。
- ハイブリッドツール:ハードウェア制御用のローカルPythonツールと、外部APIアクセス用のリモートMCPツールの両方をサポート。
- 統合されたモーション:ダンスや感情を表現するための動きのライブラリを含み、音声と融合します。
- Web UI:プロフィール、ツール、設定を管理するためのオプションインターフェース。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト