LvcidPsyche/auto-browser
Give your AI agent a real browser — with a human in the loop. Open-source MCP-native browser agent.
What it solves
Auto Browser는 AI 에이전트가 실제 웹 브라우저와 상호 작용하면서 인간이 루프에 남아 있을 수 있는 방법을 제공합니다. 이는 다음을 통해 깨지기 쉬운 웹 자동화 문제를 해결합니다.
- 실시간 세션에 대한 인간 인수인계 허용
- 재사용 가능한 인증 프로필을 관리하여 에이전트가 반복 로그인할 필요 없게 함
- 승인 게이트와 PII 스크러빙 같은 안전 장치를 제공하여 승인된 워크플로를 보호
How it works
시스템은 Playwright를 통해 Chromium을 실행하는 브라우저 노드와 컨트롤러 API로 구성됩니다. MCP(Model Context Protocol) 서버로 구축되어 Claude Desktop이나 Cursor와 같은 LLM 클라이언트와 직접 통합됩니다. OpenAI, Claude, Gemini 및 Ollama, Groq와 같은 OpenAI 호환 엔드포인트를 포함한 다양한 모델 제공자를 지원하여 브라우저를 구동합니다. noVNC 인터페이스를 통해 인간 운영자가 실시간으로 세션을 시각적으로 모니터링하거나 인수인계할 수 있습니다.
Who it’s for
- 단순 HTML 가져오기가 아닌 전체 브라우저가 필요한 MCP 기반 에이전트 워크플로를 구축하는 개발자
- 취약한 사이트에 대해 인간 복구가 필요한 내부 대시보드 또는 관리 도구를 관리하는 팀
- 운영자 지원 브라우저 디버깅을 수행하는 QA 엔지니어
- 지속적이고 재사용 가능한 로그인 세션으로 계정 워크플로를 자동화하려는 사용자
Highlights
- MCP-native: 처음부터 MCP 서버로 통합되어 원활한 LLM 에이전트 연결을 구현.
- Human-in-the-loop: 자동화가 실패하거나 인간 개입이 필요할 때 noVNC를 통해 실시간 세션 인수인계.
- Auth Profile Management: 명명된 인증 상태를 저장·재사용하여 반복 로그인 방지.
- Safety and Compliance: 내장된 승인 게이트, 운영자 신원 추적, PII 스크러빙 및 정책 프리셋(예: 엄격 또는 균형) 제공.
- Broad Model Support: OpenAI 호환 어댑터를 통해 거의 모든 최첨단 모델 지원.
- Convergence Harness: "Agent Skill Induction"을 위한 도구로, 브라우저 트레이스를 기록·검증하여 재현 가능한 에이전트 스킬을 생성.