LvcidPsyche/auto-browser

Give your AI agent a real browser — with a human in the loop. Open-source MCP-native browser agent.

解決する課題

Auto Browserは、AIエージェントが人間の監視を維持しながら実際のウェブブラウザと対話する方法を提供します。エージェントが行き詰まったり失敗したりする可能性のある「脆い」ウェブ自動化の問題を、人間がリアルタイムでセッションを引き継ぐことを可能にすることで解決します。また、ユーザーが一度ログインしてそのセッションを再利用可能な認証プロファイルとして保存できるようにすることで、認証の課題にも対処します。

仕組み

このシステムは、Model Context Protocol (MCP)、REST API、または専用のSDKを介してLLMによって駆動できる、Playwrightベースのブラウザコントロールプレーンを使用しています。セッションとポリシーを管理するコントローラーAPIと、Chromiumを実行するブラウザノードで構成されています。主な特徴はnoVNCの統合であり、これにより人間のオペレーターがライブブラウザセッションを視覚的に監視したり、引き継いだりすることができます。システムは、さまざまな知覚プリセット(コスト効率のためのテキストのみなど)をサポートしており、OpenAI互換のあらゆるモデルによって駆動できます。

対象者

  • 実際のブラウザを必要とするMCPベースのエージェントワークフローを構築している開発者。
  • オペレーターによる支援が必要なQAやブラウザのデバッグを行うチーム。
  • AIエージェントを介して内部ダッシュボードや管理ツールを管理するユーザー。
  • PII(個人識別情報)のスクラビングや承認ゲートを備えた、安全で監査可能なブラウザ自動化を必要とするユーザー。

ハイライト

  • MCPネイティブ: Claude DesktopやCursorなどのクライアントとシームレスに統合できるよう、MCPサーバーとしてゼロから構築されています。
  • Human-in-the-loop: 自動化が失敗した際に、noVNCを介してライブセッションの引き継ぎが可能。
  • 再利用可能な認証: 名前付きの認証プロファイルを保存して再開できるため、繰り返しのログインを回避できます。
  • 安全性とコンプライアンス: 承認ゲート、PIIスクラビング、監査トレイル用のEd25519署名付きWitnessレシート、および事前設定されたコンプライアンステンプレート(例:厳格、バランス型)が含まれています。
  • Convergence Harness: エージェントのスキル誘導(Agent Skill Induction)のためのツールであり、改ざん防止チェック済みのトレースを記録・検証して、段階的なスキル候補を作成します。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト