leeguooooo/image-use
Use your ChatGPT subscription to generate images from the command line — no OPENAI_API_KEY, no gateway, no daemon. Zero-dep Python CLI + AI-agent skill.
何を解決するか
image-use は、依存関係ゼロの Python CLI ツールで、OpenAI API キーを必要とせず、既存の ChatGPT または Gemini サブスクリプション(無料トライアルも含む)を使って画像生成が可能になります。個人のサブスクリプションをプログラム可能な画像生成インターフェースに変換します。
動作方法
このツールは複数のバックエンドを提供して AI サービスと連携します:
- Web バックエンド:ログイン済みの Chrome ブラウザを制御して、ChatGPT のウェブチャットインターフェースと対話します。
- Codex バックエンド:ヘッドレスなフォールバックで、内部エンドポイントを使用します。
- Gemini バックエンド:ログイン済みの Chrome ブラウザ(
--backend gemini)または Antigravity CLI(--backend agy)を使用して、Google Gemini で画像を生成します。
画像から画像へのリファレンス、コンポジションリファレンス、および ImageMagick と libwebp を使用してスプライトシートを WebP または GIF ファイルに変換することで、シンプルなアニメーションの生成をサポートしています。
対象ユーザー
API クレジットの支払いを避け、既存のウェブベースのサブスクリプションを活用して、ワークフローや CLI 環境(例:Claude Code、Cursor、Codex)に画像生成を統合したい開発者や AI エージェントユーザー。
特徴
- API キー不要:既存のブラウザセッションや内部エンドポイントを使用して、資金が入った API アカウントの必要を回避。
- AI エージェント統合:
npx skills addを通じて Claude Code や Cursor などのエージェントに「スキル」として追加可能。 - キャラクターの一貫性:リファレンス画像を使ってキャラクターをピン固定し、異なるシーン間で一貫性を維持。
- コミュニティスタイル:パブリックギャラリー(
drawstyle.leeguoo.com)と連携し、カスタムアートスタイルの検索、ダウンロード、公開が可能。 - アニメーションサポート:スプライトシートからピングポングループアニメーションを生成可能。
- マルチバックエンド対応:ChatGPT と Gemini バックエンド間で柔軟に切り替え可能。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト