pipecat-ai/pipecat-client-web
Real-Time Voice Inference Web SDK
何を解決するか
Pipecatフレームワークを使用して構築された音声およびマルチモーダルAIボットとWebアプリケーションが接続・通信するための標準化された方法を提供します。クライアント側でのデバイスメディアストリーム、ボット設定、セッション状態の管理の複雑さを排除します。
動作方法
このプロジェクトは、JavaScript/TypeScript SDK(client-js)とReactコンポーネントおよびフック(client-react)のセットを含むモノレポです。ユーザーのブラウザとPipecatサーバーの間のブリッジとして機能します。実際に音声および動画データを送信するには、WebRTC(Dailyなど)などの別途のトランスポート実装が必要です。
また、UI Worker Protocol(v1)を実装しており、サーバーサイドのAIワーカーが構造化されたワイヤフォーマット(アクセシビリティスナップショットストリーミングやUIコマンド処理を含む)を通じてWebアプリケーションのGUIを観察・制御できるようにします。
対象ユーザー
リアルタイム音声・動画・インタラクティブUIの同期を必要とするマルチモーダルAIエージェントのWebベースインターフェースを開発する開発者
特徴
- 二重パッケージ対応:Vanilla JS/TS SDKと専用のReactバインディングの両方を提供。
- UI Worker Protocol:サーバーサイドのボットがクライアント側GUIと相互作用・制御できるようにします。
- トランスポート非依存:基本のTransportクラスを使用し、開発者が異なるメディアプロバイダーを挿入可能。
- セッション管理:ボット接続、メディアストリーム管理、エラー状態の組み込み対応。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト