wuyoscar/GPT-Image2-Skill

GPT Image 2 prompt gallery, image prompt library, agentic skill, and CLI for OpenAI image generation/editing

解决的问题

本项目提供了一个精选的高质量提示词库和一套工具,旨在充分利用 OpenAI 的 gpt-image-2 模型。通过为各种风格(例如:研究论文插图、UI 原型、摄影)提供经过验证的提示词库,以及用于轻松执行这些提示词的 CLI/代理技能,解决了图像生成中的“提示词工程”问题。

工作原理

本项目通过三个主要接口运行:

  1. 提示词库 (Prompt Gallery): 按类别(例如:Anime、Gaming、Typography)组织的精选提示词集合,并带有尺寸和质量设置的元数据。
  2. CLI 工具: 一个命令行界面 (gpt-image),允许用户通过文本生成图像、执行基于引用的编辑(单引用或多引用),并使用 OpenAI API 处理基于掩码的局部重绘 (inpainting)。
  3. 代理技能 (Agentic Skill): 一个即插即用的技能文件夹,可以集成到 Claude Code、Codex、OpenClaw 和 Hermes Agent 等代理运行时中,允许这些代理使用自然语言请求来生成图像。

适用对象

  • AI 图像创作者: 希望无需反复尝试即可开始高质量图像生成的用户。
  • 代理用户: 使用 AI 代理(如 Claude Code 或 Codex)并希望赋予代理图像生成能力的人员。
  • 研究/设计专业人士: 需要为学术论文或海报提供参考草图、UI 原型或风格目标的专业人士。

亮点

  • 多重引用编辑: 支持使用多个输入图像来组合元素(例如:将一个图像中的主体放入另一个图像中)。
  • 代理集成: 通过标准化的技能系统,为安装到各种代理运行时提供一流支持。
  • 全面的参考资料: 包括详细的提示词编写检查清单,以及对 OpenAI cookbook 中图像生成内容的逐字记录。
  • 灵活的 CLI 参数: 对图像尺寸、质量 (low/medium/high)、格式和审核设置进行精细控制。

相关

  • 项目
  • Dispatch
  • 项目
  • 项目
  • 项目