ChatGPT Images 2.5 发布说明 / 更新内容

OpenAI 推出了 ChatGPT Images 2.5,这是一款旨在提高视觉保真度、编辑精度和生成速度的最先进图像模型。与 Images 2.0 相比,此次更新将图像生成延迟降低了 50%,并为用户增加了新的交互式工具,以引导创作过程。

改进的图像保真度和参考处理

Images 2.5 增强了将主体从参考照片转换到不同场景、风格和构图的能力,同时保持主体的可识别性。该模型能够产生更自然的光照、更丰富的纹理以及更好地保留特征,使参考引导的工作流对最终用户和 API 开发人员都更加可靠。

精准度与多轮编辑

Images 2.5 中的编辑更加聚焦,允许用户修改特定元素——例如产品或背景——而不改变图像的其他部分。这种精准度在多轮对话中得以保持,确保早期的更改保持一致,并且随着指令变得更加具体,图像质量不会下降。

智能、风格与布局

该模型展示了对复杂视觉指令和现实世界信息的改进理解。关键技术改进包括:

  • Complex Layouts: 更好地处理布局,包括生成透明背景。
  • Visual Style Alignment: 在反映所请求的艺术愿景和创意简报方面的准确性有所提高。
  • Content Accuracy: 在图像中更准确地表示现实世界的信息。

ChatGPT 中的新创意工具

OpenAI 引入了几项产品功能,以让用户对图像创作拥有更多控制权:

  • Sketch: 一项允许用户直接在 ChatGPT 中绘制粗略布局或涂鸦的功能(通过 @Sketch 命令),用作最终图像的视觉引导。
  • Templates: 针对热门创意需求预定义的格式,例如 "Poster" 或 "Merch",以帮助用户构建提示词。
  • Direct Comments: 直接在图像上放置注释的能力,以便进行更集中的编辑。
  • Prompt Sharing: 用户现在可以分享用于生成图像的特定提示词,以便他人复制或改编这些创意。

API 模型选项

对于开发人员,OpenAI 正通过 API 发布两个不同的模型:

  • GPT-Image-2.5 Flare: 大多数应用程序的默认选择,提供与聊天界面相同的质量和速度改进,包括比 GPT-Image-2 降低 50% 的延迟。
  • GPT-Image-2.5 Sunburst: 针对需要更高精度和更严格编辑控制的高级视觉工作流而优化的模型,尽管其生成时间较长。

安全性与可用性

ChatGPT Images 2.5 可供所有 ChatGPT、ChatGPT Work 和 Codex 用户在桌面端、移动端和 Web 端使用。为了确保安全性,该模型采用了提示词和图像检查以防止有害输出,利用 C2PA 元数据,并实施了不可见水印。详细评估可在系统卡片中查看。

Sources