leeguooooo/image-use

Use your ChatGPT subscription to generate images from the command line — no OPENAI_API_KEY, no gateway, no daemon. Zero-dep Python CLI + AI-agent skill.

何を解決するか

image-use は、依存関係ゼロの Python CLI ツールで、OpenAI API キーを必要とせず、既存の ChatGPT または Gemini サブスクリプション(無料トライアルも含む)を使って画像生成が可能になります。個人のサブスクリプションをプログラム可能な画像生成インターフェースに変換します。

動作方法

このツールは複数のバックエンドを提供して AI サービスと連携します:

  • Web バックエンド:ログイン済みの Chrome ブラウザを制御して、ChatGPT のウェブチャットインターフェースと対話します。
  • Codex バックエンド:ヘッドレスなフォールバックで、内部エンドポイントを使用します。
  • Gemini バックエンド:ログイン済みの Chrome ブラウザ(--backend gemini)または Antigravity CLI(--backend agy)を使用して、Google Gemini で画像を生成します。

画像から画像へのリファレンス、コンポジションリファレンス、および ImageMagick と libwebp を使用してスプライトシートを WebP または GIF ファイルに変換することで、シンプルなアニメーションの生成をサポートしています。

対象ユーザー

API クレジットの支払いを避け、既存のウェブベースのサブスクリプションを活用して、ワークフローや CLI 環境(例:Claude Code、Cursor、Codex)に画像生成を統合したい開発者や AI エージェントユーザー。

特徴

  • API キー不要:既存のブラウザセッションや内部エンドポイントを使用して、資金が入った API アカウントの必要を回避。
  • AI エージェント統合npx skills add を通じて Claude Code や Cursor などのエージェントに「スキル」として追加可能。
  • キャラクターの一貫性:リファレンス画像を使ってキャラクターをピン固定し、異なるシーン間で一貫性を維持。
  • コミュニティスタイル:パブリックギャラリー(drawstyle.leeguoo.com)と連携し、カスタムアートスタイルの検索、ダウンロード、公開が可能。
  • アニメーションサポート:スプライトシートからピングポングループアニメーションを生成可能。
  • マルチバックエンド対応:ChatGPT と Gemini バックエンド間で柔軟に切り替え可能。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト