LvcidPsyche/auto-browser

Give your AI agent a real browser — with a human in the loop. Open-source MCP-native browser agent.

What it solves

Auto Browser 提供了一種方式,讓 AI 代理能與真實的網頁瀏覽器互動,同時讓人類保持在迴路中。它解決了脆弱的網頁自動化問題,透過以下方式:

  • 允許人工即時接管活躍會話
  • 管理可重複使用的驗證設定檔,讓代理不必重複登入
  • 提供安全防護,如批准門檻與個人資訊刪除,適用於授權工作流程

How it works

系統由一個控制器 API 與一個透過 Playwright 執行 Chromium 的瀏覽器節點組成。它以 MCP(Model Context Protocol)伺服器的形式建置,能直接與 Claude Desktop、Cursor 等 LLM 客戶端整合。支援多種模型提供者(OpenAI、Claude、Gemini,以及相容 OpenAI 的端點如 Ollama 或 Groq)來驅動瀏覽器。noVNC 介面讓人類操作員能即時視覺監控或接管會話。

Who it’s for

  • 開發者:構建需要完整瀏覽器而非單純 HTML 抓取的 MCP 驅動代理工作流程。
  • 團隊:管理內部儀表板或管理工具,需在人為介入下復原脆弱網站。
  • QA 工程師:執行操作員協助的瀏覽器除錯。
  • 使用者:需要以持久、可重複使用的登入會話自動化帳號工作流程。

Highlights

  • MCP-native:從一開始即作為 MCP 伺服器整合,實現無縫的 LLM 代理連接。
  • Human-in-the-loop:當自動化失敗或需要人工介入時,可透過 noVNC 進行即時會話接管。
  • Auth Profile Management:可儲存與重用具名的驗證狀態,避免重複登入。
  • Safety and Compliance:內建批准門檻、操作員身份追蹤、PII 刪除與政策預設(例如嚴格或平衡模式)。
  • Broad Model Support:透過相容 OpenAI 的介面,支援幾乎所有前沿模型。
  • Convergence Harness:用於「Agent Skill Induction」的工具,記錄與驗證瀏覽器軌跡,以建立可重複的代理技能。