WJZ-P/gemini-skill

gemini drawing MCP & skill through browser, can be used in openclaw or any agent that supports MCP. Gemini画图 MCP和sill,支持龙虾或任何agent使用٩(๑>◡<๑)۶

何を解決するか

Gemini Skill は Gemini の Web インターフェースの自動化を可能にし、ユーザーがブラウザを手動で操作せずに、AI 画像生成、複数ターンのテキスト会話、画像抽出などのタスクを実行できるようにします。AI エージェント(Model Context Protocol 経由)と Gemini Web UI の間のギャップを埋め、Web インターフェースをプログラム可能なツールに変換します。

動作方法

このプロジェクトは Chrome DevTools Protocol (CDP) と Puppeteer(ボット検出を回避するためのステalth プラグイン付き)を使用してブラウザインスタンスを制御します。"デーモン"アーキテクチャを採用しており、バックグラウンドプロセスがブラウザのライフサイクルを管理し、30分間の非アクティビティ後に自動的にシャットダウンしてリソースを節約します。

MCP(Model Context Protocol)サーバーとして実装されており、Claude や CodeBuddy などの MCP 対応 AI クライアントに接続可能です。AI クライアントが MCP サーバーにリクエストを送信すると、サーバーはそのリクエストを gemini.google.com 上のブラウザ操作に変換します。

対象ユーザー

  • Gemini の Web 機能(特に画像生成)を利用できるようにしたい AI エージェント開発者
  • Gemini Web インターフェースで繰り返し行われるタスクを自動化したいパワーユーザー
  • 他のワークフローに Gemini の Web 機能を標準化されたプロトコル経由で統合したい開発者

特徴

  • 完全自動化: 画像生成、参照用画像のアップロード、高解像度画像のダウンロードをサポート
  • MCP 統合: 標準化されたインターフェースにより、任意の MCP 対応クライアントが Gemini を制御可能
  • スマートなライフサイクル管理: バックグラウンドデーモンが必要に応じてブラウザを起動し、非アクティビティ後に遅延破棄を処理
  • 検出回避: puppeteer-extra-plugin-stealth を使用して自動化検出を回避
  • 画像処理: ダウンロードした画像から自動的に透かしを削除する機能を内蔵
  • Atlas Cloud サポート: OpenAI 互換プロバイダーをオプションで提供し、さまざまなモデルへの直接 API アクセスを可能に

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト