LvcidPsyche/auto-browser
Give your AI agent a real browser — with a human in the loop. Open-source MCP-native browser agent.
What it solves
Auto Browser 提供了一種方式,讓 AI 代理能與真實的網頁瀏覽器互動,同時讓人類保持在迴路中。它解決了脆弱的網頁自動化問題,透過以下方式:
- 允許人工即時接管活躍會話
- 管理可重複使用的驗證設定檔,讓代理不必重複登入
- 提供安全防護,如批准門檻與個人資訊刪除,適用於授權工作流程
How it works
系統由一個控制器 API 與一個透過 Playwright 執行 Chromium 的瀏覽器節點組成。它以 MCP(Model Context Protocol)伺服器的形式建置,能直接與 Claude Desktop、Cursor 等 LLM 客戶端整合。支援多種模型提供者(OpenAI、Claude、Gemini,以及相容 OpenAI 的端點如 Ollama 或 Groq)來驅動瀏覽器。noVNC 介面讓人類操作員能即時視覺監控或接管會話。
Who it’s for
- 開發者:構建需要完整瀏覽器而非單純 HTML 抓取的 MCP 驅動代理工作流程。
- 團隊:管理內部儀表板或管理工具,需在人為介入下復原脆弱網站。
- QA 工程師:執行操作員協助的瀏覽器除錯。
- 使用者:需要以持久、可重複使用的登入會話自動化帳號工作流程。
Highlights
- MCP-native:從一開始即作為 MCP 伺服器整合,實現無縫的 LLM 代理連接。
- Human-in-the-loop:當自動化失敗或需要人工介入時,可透過 noVNC 進行即時會話接管。
- Auth Profile Management:可儲存與重用具名的驗證狀態,避免重複登入。
- Safety and Compliance:內建批准門檻、操作員身份追蹤、PII 刪除與政策預設(例如嚴格或平衡模式)。
- Broad Model Support:透過相容 OpenAI 的介面,支援幾乎所有前沿模型。
- Convergence Harness:用於「Agent Skill Induction」的工具,記錄與驗證瀏覽器軌跡,以建立可重複的代理技能。