WJZ-P/gemini-skill
gemini drawing MCP & skill through browser, can be used in openclaw or any agent that supports MCP. Gemini画图 MCP和sill,支持龙虾或任何agent使用٩(๑>◡<๑)۶
何を解決するか
Gemini Skill は Gemini の Web インターフェースの自動化を可能にし、ユーザーがブラウザを手動で操作せずに、AI 画像生成、複数ターンのテキスト会話、画像抽出などのタスクを実行できるようにします。AI エージェント(Model Context Protocol 経由)と Gemini Web UI の間のギャップを埋め、Web インターフェースをプログラム可能なツールに変換します。
動作方法
このプロジェクトは Chrome DevTools Protocol (CDP) と Puppeteer(ボット検出を回避するためのステalth プラグイン付き)を使用してブラウザインスタンスを制御します。"デーモン"アーキテクチャを採用しており、バックグラウンドプロセスがブラウザのライフサイクルを管理し、30分間の非アクティビティ後に自動的にシャットダウンしてリソースを節約します。
MCP(Model Context Protocol)サーバーとして実装されており、Claude や CodeBuddy などの MCP 対応 AI クライアントに接続可能です。AI クライアントが MCP サーバーにリクエストを送信すると、サーバーはそのリクエストを gemini.google.com 上のブラウザ操作に変換します。
対象ユーザー
- Gemini の Web 機能(特に画像生成)を利用できるようにしたい AI エージェント開発者
- Gemini Web インターフェースで繰り返し行われるタスクを自動化したいパワーユーザー
- 他のワークフローに Gemini の Web 機能を標準化されたプロトコル経由で統合したい開発者
特徴
- 完全自動化: 画像生成、参照用画像のアップロード、高解像度画像のダウンロードをサポート
- MCP 統合: 標準化されたインターフェースにより、任意の MCP 対応クライアントが Gemini を制御可能
- スマートなライフサイクル管理: バックグラウンドデーモンが必要に応じてブラウザを起動し、非アクティビティ後に遅延破棄を処理
- 検出回避:
puppeteer-extra-plugin-stealthを使用して自動化検出を回避 - 画像処理: ダウンロードした画像から自動的に透かしを削除する機能を内蔵
- Atlas Cloud サポート: OpenAI 互換プロバイダーをオプションで提供し、さまざまなモデルへの直接 API アクセスを可能に
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト