ChatGPT Images 和 GPT Image 1.5 發布

OpenAI 已推出 ChatGPT Images 的新版本,由新旗艦圖像生成模型驅動。此更新在生成速度、精準編輯和指令遵循方面帶來顯著改進,使用戶能夠在保持跨迭代一致細節的同時創建和修改圖像。

精準圖像編輯與保存

GPT Image 1.5 允許對上傳的圖像進行更可靠的編輯,確保變更僅在請求的位置發生,同時保留光線、構圖和人物外觀等關鍵元素。此功能使得更可信的服裝與髮型試穿、實用的照片編輯以及保留原始圖像本質的概念轉換成為可能。

編輯能力

該模型在圖像內的元素添加、減去、結合、混合和轉置方面表現出色。例如,使用者可以將不同圖像中的多個主題結合到單一場景中,或改變特定元素的風格(例如,將人物變為復古動漫風格),同時保持圖像其他部分不變。

創意轉換

該模型能夠執行複雜的轉換,例如將照片轉換為帶有特定文字和佈局變更的電影海報,同時保持主題的相似度。這些轉換可以透過文字提示或新 Images 功能中的預設樣式來觸發。

指令遵循與文字渲染

相較於初始版本,指令遵循已得到改進,使得能夠創建更複雜的原始構圖,並更好地保持元素之間的關係。此外,該模型在渲染更密集且較小的文字方面取得進展,使其能夠製作具有精確格式和數字的真實報紙文章或信息圖。

新專屬創作空間

OpenAI 在 ChatGPT 側邊欄內推出了專屬的 Images 體驗(可在行動應用程式和 chatgpt.com 使用)。此空間旨在透過以下方式簡化創意探索:

  • Preset Filters and Prompts: 几十個定期更新的濾鏡和熱門提示詞,可快速啟發靈感。
  • Likeness Upload: 一次性上傳使用者外觀,可在未來創作中重複使用,無需每次上傳新照片。
  • Parallel Generation: 使用者可以在其他圖像仍在生成時繼續生成新圖像,以減少等待時間。

效能與 API 可用性

Images 現在的渲染速度比先前版本快上至四倍。雖然 OpenAI 指出結果仍不完美,在多語言支援和多臉部等方面仍有改進空間,但該模型在生動圖形和避免過早裁剪方面顯示出明顯進展。

GPT Image 1.5 在 API 中

開發者可透過 API 以 GPT Image 1.5 的形式存取新模型。此版本相比 GPT Image 1 提供更強的圖像保存與編輯功能,特別適合品牌工作、標誌設計以及電子商務產品目錄。

Key API updates include:

  • Cost Reduction: 與 GPT Image 1 相比,圖像輸入和輸出現在便宜了 20%。
  • Industry Adoption: Wix、Canva、Figma 和 Shutterstock 等公司已經開始使用該模型。

可用性

新的 ChatGPT Images 模型正在全球範圍內向所有 ChatGPT 用戶和 API 推出。先前版本的 ChatGPT Images 仍可作為自訂 GPT 使用。

Sources