browser-use/web-ui

🖥️ Run AI Agent in your browser.

何を解決するか

このプロジェクトは、browser-use ライブラリ用の使いやすいグラフィカルインターフェースを提供し、ユーザーがウェブサイトをナビゲートおよび操作できる AI エージェントと対話できるようにします。コードを書く必要なく、エージェント駆動のブラウザ自動化タスクをトリガーできます。

動作方法

Gradio を基盤として構築された WebUI は、ブラウザエージェントのコントロールパネルとして機能します。Google、OpenAI、Azure OpenAI、Anthropic、DeepSeek、Ollama などのさまざまな大規模言語モデル(LLM)と統合されています。ユーザーは、認証セッションを維持し、ウェブサイトへの再ログインを回避するために、カスタムローカルブラウザインスタンスを使用できるようにエージェントを設定できます。

対象ユーザー

Pythonスクリプトを書く必要なく AI ブラウザエージェントを操作したいユーザー、およびブラウザ自動化エージェントを視覚的に監視・管理したい開発者。

特徴

  • 広範な LLM 対応: DeepSeek、Anthropic、Ollama を含む多数のプロバイダーと互換性があります。
  • カスタムブラウザ統合: ローカルブラウザ実行可能ファイルとユーザーデータディレクトリを使用して、認証の障壁を回避できます。
  • 永続的なセッション: 異なる AI タスクの間でブラウザウィンドウをオープンしたままにし、状態を維持できます。
  • 詳細なモニタリング: Docker で実行する場合、高解像度の画面記録と VNC ビューアーへのアクセスをサポートしています。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト