LvcidPsyche/auto-browser

Give your AI agent a real browser — with a human in the loop. Open-source MCP-native browser agent.

해결하는 문제

Auto Browser는 AI 에이전트가 인간의 감독을 유지하면서 실제 웹 브라우저와 상호 작용할 수 있는 방법을 제공합니다. 에이전트가 막히거나 실패할 수 있는 "취약한" 웹 자동화 문제를 인간이 실시간으로 세션을 인수할 수 있도록 하여 해결합니다. 또한 사용자가 한 번 로그인하고 해당 세션을 재사용 가능한 인증 프로필로 저장할 수 있게 하여 인증 문제를 해결합니다.

작동 방식

이 시스템은 Model Context Protocol (MCP), REST API 또는 전용 SDK를 통해 LLM에 의해 구동될 수 있는 Playwright 기반 브라우저 컨트롤 플레인을 사용합니다. 세션과 정책을 관리하는 컨트롤러 API와 Chromium을 실행하는 브라우저 노드로 구성됩니다. 주요 특징은 noVNC 통합으로, 이를 통해 인간 운영자가 라이브 브라우저 세션을 시각적으로 관찰하거나 인수할 수 있습니다. 시스템은 다양한 인지 프리셋(비용 효율성을 위한 텍스트 전용 등)을 지원하며 모든 OpenAI 호환 모델에 의해 구동될 수 있습니다.

대상

  • 실제 브라우저가 필요한 MCP 기반 에이전트 워크플로우를 구축하는 개발자.
  • 운영자 지원 QA 및 브라우저 디버깅이 필요한 팀.
  • AI 에이전트를 통해 내부 대시보드 또는 관리 도구를 관리하는 사용자.
  • PII 스크러빙 및 승인 게이트가 포함된 안전하고 감사 가능한 브라우저 자동화를 필요로 하는 사용자.

주요 특징

  • MCP 네이티브: Claude Desktop 및 Cursor와 같은 클라이언트와 원활하게 통합되도록 MCP 서버로 처음부터 구축되었습니다.
  • Human-in-the-loop: 자동화 실패 시 noVNC를 통한 라이브 세션 인수.
  • 재사용 가능한 인증: 반복적인 로그인을 피하기 위해 이름이 지정된 인증 프로필을 저장하고 다시 열 수 있습니다.
  • 안전 및 준수: 승인 게이트, PII 스크러빙, 감사 추적을 위한 Ed25519 서명 Witness 영수증 및 사전 구성된 준수 템플릿(예: 엄격함, 균형 잡힘)이 포함되어 있습니다.
  • Convergence Harness: 에이전트 기술 유도(Agent Skill Induction)를 위한 도구로, 변조 확인된 트레이스를 기록하고 검증하여 단계별 기술 후보를 생성합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트