leeguooooo/image-use

Use your ChatGPT subscription to generate images from the command line — no OPENAI_API_KEY, no gateway, no daemon. Zero-dep Python CLI + AI-agent skill.

解決的問題

image-use 是一個零相依的 Python CLI 工具,允許使用者使用現有的 ChatGPT 或 Gemini 訂閱(包含免費層)產生圖像,無需額外的 OPENAI_API_KEY 或付費 API 計費。它有效將個人訂閱轉化為可程式化的圖像生成介面。

工作原理

此工具提供多種後端以與 AI 服務互動:

  • Web 後端:驅動已登入的 Chrome 瀏覽器,與 ChatGPT 網頁聊天介面互動。
  • Codex 後端:無頭備用方案,使用內部端點。
  • Gemini 後端:使用已登入的 Chrome 瀏覽器(--backend gemini)或 Antigravity CLI(--backend agy)透過 Google Gemini 產生圖像。

支援進階功能,如圖像到圖像參考、構圖參考,以及透過產生精灵圖並使用 ImageMagick 和 libwebp 處理為 WebP 或 GIF 檔案來建立簡單動畫。

適用對象

希望在工作流程或 CLI 環境(如 Claude Code、Cursor 或 Codex)中整合圖像產生功能,但又不想支付 API 信用額度費用的開發者與 AI 代理使用者,可利用其現有的網頁訂閱。

特色亮點

  • 無需 API 金鑰:使用現有瀏覽器會話或內部端點,無需付費 API 帳戶。
  • AI 代理整合:可透過 npx skills add 將其作為「技能」加入 Claude Code 和 Cursor 等代理中。
  • 角色一致性:支援透過參考圖像固定角色,以在不同場景中保持一致性。
  • 社群風格:整合公開畫廊(drawstyle.leeguoo.com),支援搜尋、下載與發布自訂藝術風格。
  • 動畫支援:可從精灵圖產生 ping-pong 循環動畫。
  • 多後端支援:可在 ChatGPT 與 Gemini 後端之間靈活切換。

相關

  • 專案
  • 專案
  • 專案
  • 專案