leeguooooo/image-use
Use your ChatGPT subscription to generate images from the command line — no OPENAI_API_KEY, no gateway, no daemon. Zero-dep Python CLI + AI-agent skill.
解决的问题
image-use 是一个零依赖的 Python CLI 工具,允许用户使用现有的 ChatGPT 或 Gemini 订阅(包括免费版)生成图像,而无需单独的 OPENAI_API_KEY 或付费 API 计费。它将个人订阅有效转化为可编程的图像生成接口。
工作原理
该工具提供多种后端以与 AI 服务交互:
- Web 后端:驱动已登录的 Chrome 浏览器,与 ChatGPT 网页聊天界面进行交互。
- Codex 后端:无头备用方案,使用内部接口。
- Gemini 后端:使用已登录的 Chrome 浏览器(
--backend gemini)或 Antigravity CLI(--backend agy)通过 Google Gemini 生成图像。
支持高级功能,如图像到图像参考、构图参考,以及通过生成精灵图并使用 ImageMagick 和 libwebp 处理为 WebP 或 GIF 文件来创建简单动画。
适用人群
希望在工作流或 CLI 环境(如 Claude Code、Cursor 或 Codex)中集成图像生成功能,但又不想支付 API 信用额度费用的开发者和 AI 代理用户,可利用其现有的基于网页的订阅。
特色亮点
- 无需 API 密钥:使用现有浏览器会话或内部接口,无需付费 API 账户。
- AI 代理集成:可通过
npx skills add将其作为「技能」添加到 Claude Code 和 Cursor 等代理中。 - 角色一致性:支持通过参考图像固定角色,以在不同场景中保持一致性。
- 社区风格:集成公共画廊(
drawstyle.leeguoo.com),支持搜索、下载和发布自定义艺术风格。 - 动画支持:可从精灵图生成 ping-pong 循环动画。
- 多后端支持:可在 ChatGPT 和 Gemini 后端之间灵活切换。
相关
- 项目
- 项目
- 项目
- 项目