LvcidPsyche/auto-browser

Give your AI agent a real browser — with a human in the loop. Open-source MCP-native browser agent.

解决的问题

Auto Browser 提供了一种让 AI 智能体在保持人工监督的同时与真实 Web 浏览器交互的方法。它通过允许人类实时介入并接管会话,解决了智能体可能会卡住或失败的“脆弱”网络自动化问题。它还通过允许用户登录一次并将这些会话保存为可重用的身份验证配置文件,解决了身份验证的挑战。

工作原理

该系统使用基于 Playwright 的浏览器控制平面,可以通过 Model Context Protocol (MCP)、REST API 或专用 SDK 由 LLM 驱动。它由一个管理会话和策略的控制器 API 和一个运行 Chromium 的浏览器节点组成。一个关键特性是集成了 noVNC,允许人类操作员视觉化地观察或接管实时浏览器会话。该系统支持各种感知预设(例如为了成本效率而采用的仅文本模式),并可以由任何兼容 OpenAI 的模型驱动。

适用对象

  • 构建需要真实浏览器的 MCP 驱动型智能体工作流的开发人员。
  • 需要操作员辅助的 QA 和浏览器调试的团队。
  • 通过 AI 智能体管理内部仪表板或管理工具的用户。
  • 需要具有 PII 脱敏和审批闸门的安全性、可审计的浏览器自动化的用户。

亮点

  • MCP 原生:从底层开始构建为 MCP 服务器,实现与 Claude Desktop 和 Cursor 等客户端的无缝集成。
  • 人机回环:当自动化失败时,通过 noVNC 进行实时会话接管。
  • 可重用身份验证:保存并重新打开命名的身份验证配置文件,以避免重复登录。
  • 安全与合规:包括审批闸门、PII 脱敏、用于审计追踪的 Ed25519 签名 Witness 收据,以及预配置的合规模板(例如:严格、平衡)。
  • Convergence Harness:一种用于智能体技能诱导(Agent Skill Induction)的工具,通过记录和验证防篡改追踪来创建阶段性技能候选者。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目