wuyoscar/GPT-Image2-Skill
GPT Image 2 prompt gallery, image prompt library, agentic skill, and CLI for OpenAI image generation/editing
解決的問題
本專案提供了一個精選的高品質提示詞庫與一套工具,旨在充分利用 OpenAI 的 gpt-image-2 模型。透過為各種風格(例如:研究論文插圖、UI 原型、攝影)提供經過驗證的提示詞庫,以及用於輕鬆執行這些提示詞的 CLI/代理技能,解決了圖像生成中的「提示詞工程」問題。
工作原理
本專案透過三個主要介面運行:
- 提示詞庫 (Prompt Gallery): 按類別(例如:Anime、Gaming、Typography)組織的精選提示詞集合,並附帶尺寸與品質設定的元數據。
- CLI 工具: 一個命令列介面 (
gpt-image),允許使用者透過文字生成圖像、執行基於引用的編輯(單引用或多引用),並使用 OpenAI API 處理基於遮罩的局部重繪 (inpainting)。 - 代理技能 (Agentic Skill): 一個即插即用的技能資料夾,可以整合到 Claude Code、Codex、OpenClaw 與 Hermes Agent 等代理執行環境中,允許這些代理使用自然語言請求來生成圖像。
適用對象
- AI 圖像創作者: 希望無需反覆嘗試即可開始高品質圖像生成的使用者。
- 代理使用者: 使用 AI 代理(如 Claude Code 或 Codex)並希望賦予代理圖像生成能力的人員。
- 研究/設計專業人士: 需要為學術論文或海報提供參考草圖、UI 原型或風格目標的專業人士。
亮點
- 多重引用編輯: 支援使用多個輸入圖像來組合元素(例如:將一個圖像中的主體放入另一個圖像中)。
- 代理整合: 透過標準化的技能系統,為安裝到各種代理執行環境提供一流支援。
- 全面的參考資料: 包括詳細的提示詞編寫檢查清單,以及對 OpenAI cookbook 中圖像生成內容的逐字記錄。
- 靈活的 CLI 參數: 對圖像尺寸、品質 (low/medium/high)、格式與審核設定進行精細控制。
相關
- 專案
- Dispatch
- 專案
- 專案
- 專案