ChatGPT Images 和 GPT Image 1.5 发布
OpenAI 已推出 ChatGPT Images 的新版本,由新一代旗舰图像生成模型驱动。此次更新在生成速度、精准编辑和指令遵循方面带来了显著提升,使用户能够在保持跨迭代一致细节的同时创建和修改图像。
精准图像编辑与保留
GPT Image 1.5 允许对上传的图像进行更可靠的编辑,确保更改仅在请求的位置发生,同时保留诸如光线、构图和人物外观等关键元素。此功能使得更可信的服装和发型试穿、实用的照片编辑以及保留原始图像精髓的概念转换成为可能。
编辑能力
该模型在图像内添加、减去、组合、混合和转置元素方面表现出色。例如,用户可以将不同图像中的多个主题合并到一个场景中,或改变特定元素的样式(例如,将人物改为复古动漫风格),同时保持图像其他部分不变。
创意转换
该模型能够执行复杂的转换,例如将照片转换为带有特定文本和布局更改的电影海报,同时保持主题的相似度。这些转换可以通过文本提示触发,或通过新 Images 功能中的预设样式实现。
指令遵循与文本渲染
相较于初始版本,指令遵循能力有所提升,能够实现更复杂的原始构图,并更好地保持元素之间的关系。此外,该模型在渲染更密集和更小的文本方面取得了进步,使其能够创建格式和数字精确的逼真报纸文章或信息图。
全新专属创作空间
OpenAI 在 ChatGPT 侧边栏中引入了专属的 Images 体验(可在移动应用和 chatgpt.com 使用)。该空间旨在通过以下方式简化创意探索:
- 预设过滤器和提示词: 数十个定期更新的过滤器和热门提示词,助力快速激发灵感。
- 相似度上传: 一次性上传用户外观,可在未来创作中重复使用,无需每次都上传新照片。
- 并行生成: 用户可以在其他图像仍在生成时继续生成新图像,从而减少等待时间。
性能与 API 可用性
图像现在渲染速度比之前的版本快多达四倍。虽然 OpenAI 指出结果仍不完美,在多语言支持和多面部等方面仍有改进空间,但该模型在生动图形和避免过早裁剪方面表现出明显进展。
API 中的 GPT Image 1.5
开发者可以通过 API 以 GPT Image 1.5 的形式访问新模型。此版本相比 GPT Image 1 提供了更强的图像保留和编辑能力,特别适用于品牌工作、Logo 创建以及电子商务产品目录。
关键 API 更新包括:
- 成本降低: 与 GPT Image 1 相比,图像输入和输出现在便宜了 20%。
- 行业采用: Wix、Canva、Figma 和 Shutterstock 等公司已经在使用该模型。
可用性
新的 ChatGPT Images 模型正在全面向所有 ChatGPT 用户和 API 推出。之前的 ChatGPT Images 版本仍然以自定义 GPT 的形式提供。
Sources
- OriginalThe new ChatGPT Images is here