livekit-examples/python-agents-examples
Runnable examples for LiveKit Agents in Python
해결하는 문제
이 리포지토리는 음성, 비디오, 전화 AI 에이전트를 개발하는 개발자를 위한 실행 가능한 예제의 포괄적인 라이브러리를 제공합니다. 기본 API 문서와 실전 적용 가능한 구현 사이의 격차를 메우며, 듣고, 말하고, 보고, 외부 시스템과 상호작용할 수 있는 AI 에이전트의 실제 사례 패턴을 보여줍니다.
작동 방식
이 프로젝트는 두 가지 주요 섹션으로 구성되어 있습니다: docs/examples/에 있는 집중적이고 단일 개념의 데모와 complex-agents/에 있는 완전한 스택의 실전형 애플리케이션입니다. LiveKit Agents 프레임워크를 사용하여 음성 인식(STT), 대규모 언어 모델(LLM), 음성 합성(TTS)의 파이프라인을 조율하며, OpenAI, Anthropic, Google Gemini, Deepgram 등의 다양한 제공업체와 통합됩니다.
대상 사용자
AI 음성 비서, 자동 전화 시스템(SIP), 시각 기능을 갖춘 다중 모달 에이전트, 또는 애니메이션 디지털 아바타를 애플리케이션에 통합하고자 하는 개발자들입니다.
주요 특징
- 다양한 에이전트 유형: SIP, 실시간 비전, 애니메이션 아바타(Hedra, Tavus) 예제 포함.
- 다중 에이전트 조율: 통화 중에 전문 에이전트로 전환하는 방법을 보여줍니다(예: 의료 선별 또는 개인 쇼핑).
- 파이프라인 커스터마이징: STT → LLM → TTS 흐름을 가로채고 수정하여 콘텐츠 필터링 또는 번역을 수행하는 예제 제공.
- 외부 통합: RAG(벡터 검색), Home Assistant, Model Context Protocol(MCP) 클라이언트 지원.
- 풀스택 데모: React 프론트엔드를 포함한 완전한 애플리케이션 예제로, 음성 기반 D&D RPG와 심층 연구 에이전트가 포함됩니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트