LvcidPsyche/auto-browser

Give your AI agent a real browser — with a human in the loop. Open-source MCP-native browser agent.

解決的問題

Auto Browser 提供了一種讓 AI 代理在保持人工監督的同時與真實 Web 瀏覽器互動的方法。它透過允許人類即時介入並接管會話,解決了代理可能會卡住或失敗的「脆弱」網路自動化問題。它還透過允許使用者登入一次並將這些會話儲存為可重用的身分驗證設定檔,解決了身分驗證的挑戰。

工作原理

該系統使用基於 Playwright 的瀏覽器控制平面,可以透過 Model Context Protocol (MCP)、REST API 或專用 SDK 由 LLM 驅動。它由一個管理會話與策略的控制器 API 和一個執行 Chromium 的瀏覽器節點組成。一個關鍵特性是集成了 noVNC,允許人類操作員視覺化地觀察或接管即時瀏覽器會話。該系統支援各種感知預設(例如為了成本效率而採用的僅文字模式),並可以由任何相容 OpenAI 的模型驅動。

適用對象

  • 建構需要真實瀏覽器的 MCP 驅動型代理工作流的開發人員。
  • 需要操作員輔助的 QA 與瀏覽器除錯的團隊。
  • 透過 AI 代理管理內部儀表板或管理工具的使用者。
  • 需要具有 PII 去識別化與審核閘門的安全、可稽核瀏覽器自動化的使用者。

亮點

  • MCP 原生:從底層開始建構為 MCP 伺服器,實現與 Claude Desktop 和 Cursor 等用戶端的無縫整合。
  • 人機回環:當自動化失敗時,透過 noVNC 進行即時會話接管。
  • 可重用身分驗證:儲存並重新開啟命名的身分驗證設定檔,以避免重複登入。
  • 安全與合規:包括審核閘門、PII 去識別化、用於稽核軌跡的 Ed25519 簽名 Witness 收據,以及預先配置的合規範本(例如:嚴格、平衡)。
  • Convergence Harness:一種用於代理技能誘導(Agent Skill Induction)的工具,透過記錄並驗證防篡改追蹤來建立階段性技能候選者。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案