Hacker-Valley-Media/Interceptor

Agent-driven Chrome extension for full browser control via CLI

解决的问题

Interceptor 为 AI 代理提供了一种方式,使其能够像人类一样控制用户实际的、正在运行的浏览器和 macOS 应用程序。它消除了对独立自动化浏览器实例(如 Playwright 或 Puppeteer 所用)的需求,这些实例常常会丢失认证会话、Cookie 和登录信息,并容易被网站检测到。

工作原理

Interceptor 通过 CLI 和一个守护进程,架起 AI 代理与操作系统之间的桥梁。它提供三个主要的「表面」:

  • 浏览器:适用于 Chrome、Brave 和 Safari 的 WebExtension,允许代理在用户现有的会话中读取 DOM 树、点击、输入,并观察网络流量。
  • macOS:使用可访问性树和操作系统级可信输入的 Swift 桥接守护进程,用于驱动原生桌面应用程序。
  • iOS:设备端的 XCUITest 运行器,允许代理通过 WiFi 控制解锁状态的 iPhone 上的应用程序。

代理通过 CLI 命令(例如 interceptor act e1)或作为 MCP(Model Context Protocol)服务器与本项目交互,可直接集成到 Claude Desktop 或 Cursor 等 AI 客户端中。

适用人群

  • 构建「计算机使用」或「浏览器使用」能力的 AI 代理开发者。
  • 希望 AI 代理在已登录的网页和桌面环境中自动化任务的用户。
  • 需要自动化 canvas 渲染编辑器(如 Google Docs)或无需手动保存对话框即可捕获原生客户端导出内容的开发者。

核心亮点

  • 会话持久性:使用用户的真实浏览器配置文件,保持 Cookie 和登录信息完整。
  • 跨平台控制:统一 CLI 支持网页、原生 macOS 应用和 iOS 应用。
  • MCP 集成:原生支持 MCP 原生 AI 客户端,便于工具注册。
  • 高级浏览器交互:绕过 isTrusted 检查,无需操作系统级键盘事件即可处理 canvas 渲染编辑器。
  • 被动网络监控:在不触发调试器横幅的情况下捕获 fetch、XHR 和 WebSocket 流量。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目