browser-use/web-ui
🖥️ Run AI Agent in your browser.
何を解決するか
このプロジェクトは、browser-use ライブラリ用の使いやすいグラフィカルインターフェースを提供し、ユーザーがウェブサイトをナビゲートおよび操作できる AI エージェントと対話できるようにします。コードを書く必要なく、エージェント駆動のブラウザ自動化タスクをトリガーできます。
動作方法
Gradio を基盤として構築された WebUI は、ブラウザエージェントのコントロールパネルとして機能します。Google、OpenAI、Azure OpenAI、Anthropic、DeepSeek、Ollama などのさまざまな大規模言語モデル(LLM)と統合されています。ユーザーは、認証セッションを維持し、ウェブサイトへの再ログインを回避するために、カスタムローカルブラウザインスタンスを使用できるようにエージェントを設定できます。
対象ユーザー
Pythonスクリプトを書く必要なく AI ブラウザエージェントを操作したいユーザー、およびブラウザ自動化エージェントを視覚的に監視・管理したい開発者。
特徴
- 広範な LLM 対応: DeepSeek、Anthropic、Ollama を含む多数のプロバイダーと互換性があります。
- カスタムブラウザ統合: ローカルブラウザ実行可能ファイルとユーザーデータディレクトリを使用して、認証の障壁を回避できます。
- 永続的なセッション: 異なる AI タスクの間でブラウザウィンドウをオープンしたままにし、状態を維持できます。
- 詳細なモニタリング: Docker で実行する場合、高解像度の画面記録と VNC ビューアーへのアクセスをサポートしています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト