LvcidPsyche/auto-browser
Give your AI agent a real browser — with a human in the loop. Open-source MCP-native browser agent.
What it solves
Auto Browser は、AI エージェントが実際のウェブブラウザとやり取りしながら、人間がループに残る方法を提供します。脆弱なウェブ自動化の問題を、以下の手段で解決します。
- ライブセッションの人間によるテイクオーバーを可能にする
- 再利用可能な認証プロファイルを管理し、エージェントが繰り返しログインする必要をなくす
- 承認ゲートや PII 削除などの安全装置を提供し、認可されたワークフローを保護する
How it works
システムは、Playwright 経由で Chromium を実行するブラウザノードとコントローラ API で構成されています。MCP(Model Context Protocol)サーバーとして構築されており、Claude Desktop や Cursor といった LLM クライアントと直接統合できます。OpenAI、Claude、Gemini、Ollama や Groq などの OpenAI 互換エンドポイントを含む幅広いモデルプロバイダーに対応し、ブラウザを駆動します。noVNC インターフェースにより、人間オペレーターがリアルタイムでセッションを視覚的に監視またはテイクオーバーできます。
Who it’s for
- フルブラウザが必要で、単純な HTML 取得では足りない MCP 駆動エージェントワークフローを構築する開発者
- 脆弱なサイトに対して人間のリカバリが必要な内部ダッシュボードや管理ツールを管理するチーム
- オペレーター支援付きブラウザデバッグを行う QA エンジニア
- 永続的で再利用可能なログインセッションを用いてアカウントワークフローを自動化したいユーザー
Highlights
- MCP-native:最初から MCP サーバーとして統合され、シームレスな LLM エージェント接続を実現。
- Human-in-the-loop:自動化が失敗したり人間の介入が必要なときに、noVNC を通じてライブセッションをテイクオーバー。
- Auth Profile Management:名前付き認証状態を保存・再利用でき、繰り返しのログインを回避。
- Safety and Compliance:組み込みの承認ゲート、オペレーターの身元追跡、PII 削除、ポリシープリセット(例:厳格またはバランス)を提供。
- Broad Model Support:OpenAI 互換アダプタを介して、ほぼすべての最先端モデルに対応。
- Convergence Harness:"Agent Skill Induction" 用ツールで、ブラウザトレースを記録・検証し、再現可能なエージェントスキルを作成。