wuyoscar/GPT-Image2-Skill
GPT Image 2 prompt gallery, image prompt library, agentic skill, and CLI for OpenAI image generation/editing
解决的问题
本项目提供了一个精选的高质量提示词库和一套工具,旨在充分利用 OpenAI 的 gpt-image-2 模型。通过为各种风格(例如:研究论文插图、UI 原型、摄影)提供经过验证的提示词库,以及用于轻松执行这些提示词的 CLI/代理技能,解决了图像生成中的“提示词工程”问题。
工作原理
本项目通过三个主要接口运行:
- 提示词库 (Prompt Gallery): 按类别(例如:Anime、Gaming、Typography)组织的精选提示词集合,并带有尺寸和质量设置的元数据。
- CLI 工具: 一个命令行界面 (
gpt-image),允许用户通过文本生成图像、执行基于引用的编辑(单引用或多引用),并使用 OpenAI API 处理基于掩码的局部重绘 (inpainting)。 - 代理技能 (Agentic Skill): 一个即插即用的技能文件夹,可以集成到 Claude Code、Codex、OpenClaw 和 Hermes Agent 等代理运行时中,允许这些代理使用自然语言请求来生成图像。
适用对象
- AI 图像创作者: 希望无需反复尝试即可开始高质量图像生成的用户。
- 代理用户: 使用 AI 代理(如 Claude Code 或 Codex)并希望赋予代理图像生成能力的人员。
- 研究/设计专业人士: 需要为学术论文或海报提供参考草图、UI 原型或风格目标的专业人士。
亮点
- 多重引用编辑: 支持使用多个输入图像来组合元素(例如:将一个图像中的主体放入另一个图像中)。
- 代理集成: 通过标准化的技能系统,为安装到各种代理运行时提供一流支持。
- 全面的参考资料: 包括详细的提示词编写检查清单,以及对 OpenAI cookbook 中图像生成内容的逐字记录。
- 灵活的 CLI 参数: 对图像尺寸、质量 (low/medium/high)、格式和审核设置进行精细控制。
相关
- 项目
- Dispatch
- 项目
- 项目
- 项目