ChatGPT Images 2.5 release notes / what's new

OpenAI는 시각적 충실도, 편집 정밀도 및 생성 속도를 향상시키기 위해 설계된 최첨단 이미지 모델인 ChatGPT Images 2.5를 출시했습니다. 이번 업데이트는 Images 2.0 대비 이미지 생성 지연 시간을 50% 단축했으며, 사용자가 창의적인 과정을 안내할 수 있는 새로운 대화형 도구를 추가했습니다.

Improved Image Fidelity and Reference Handling

Images 2.5는 피사체의 식별 가능성을 유지하면서 다양한 설정, 스타일 및 구도를 통해 참조 사진의 피사체를 변환하는 능력을 향상시킵니다. 이 모델은 더 자연스러운 조명, 더 풍부한 질감, 그리고 특징적인 요소의 더 나은 보존을 제공하여, 최종 사용자 및 API 개발자 모두에게 참조 기반 워크플로우를 더욱 신뢰할 수 있게 만듭니다.

Precision and Multi-Turn Editing

Images 2.5의 편집은 더욱 집중적입니다. 사용자는 이미지의 나머지 부분을 변경하지 않고 제품이나 배경과 같은 특정 요소를 수정할 수 있습니다. 이러한 정밀도는 여러 번의 대화 턴을 통해서도 유지되어, 이전의 변경 사항이 일관성을 유지하고 지침이 구체화됨에 따라 이미지 품질이 저하되지 않도록 보장합니다.

Intelligence, Style, and Layout

이 모델은 복잡한 시각적 지침과 실제 세계의 정보에 대한 이해도가 향상되었음을 보여줍니다. 주요 기술적 개선 사항은 다음과 같습니다:

  • Complex Layouts: 레이아웃 처리 능력이 향상되었으며, 투명 배경 생성 기능이 포함됩니다.
  • Visual Style Alignment: 요청된 예술적 비전과 크리에이티브 브리프를 반영하는 정확도가 높아졌습니다.
  • Content Accuracy: 이미지 내의 실제 세계 정보에 대한 더 정확한 표현이 가능합니다.

New Creative Tools in ChatGPT

OpenAI는 사용자가 이미지 생성에 대해 더 많은 제어권을 가질 수 있도록 여러 제품 기능을 도입했습니다:

  • Sketch: 사용자가 ChatGPT에서 직접 거친 레이아웃이나 낙서를 그릴 수 있는 기능(via the "@Sketch" command)으로, 최종 이미지의 시각적 가이드 역할을 합니다.
  • Templates: "Poster" 또는 "Merch"와 같이 인기 있는 크리에이티브 니즈를 위한 사전 정의된 형식으로, 사용자가 프롬프트를 구조화하는 데 도움을 줍니다.
  • Direct Comments: 더 집중적인 편집을 위해 이미지 위에 직접 댓글을 달 수 있는 기능입니다.
  • Prompt Sharing: 사용자는 이제 이미지를 생성하는 데 사용된 특정 프롬프트를 공유할 수 있어, 다른 사람들이 아이디어를 복제하거나 변형할 수 있습니다.

API Model Options

개발자를 위해 OpenAI는 API를 통해 두 가지 별도의 모델을 출시합니다:

  • GPT-Image-2.5 Flare: 대부분의 애플리케이션을 위한 기본 선택지로, GPT-Image-2와 비교하여 지연 시간이 50% 낮은 것을 포함하여 채팅 인터페이스와 동일한 품질 및 속도 개선 사항을 제공합니다.
  • GPT-Image-2.5 Sunburst: 편집 과정에서 더 높은 정밀도와 더 긴밀한 제어력을 요구하는 프리미엄 시각적 워크플로우에 최적화된 모델이지만, 생성 시간이 더 오래 걸립니다.

Safety and Availability

ChatGPT Images 2.5는 데스크톱, 모바일 및 웹을 통해 모든 ChatGPT, ChatGPT Work, 그리고 Codex 사용자에게 제공됩니다. 안전을 보장하기 위해, 모델은 유해한 출력을 방지하기 위해 프롬프트 및 이미지 검사를 수행하고, C2PA 메타데이터를 활용하며, 보이지 않는 워터마킹을 구현합니다. 자세한 평가 내용은 시스템 카드에서 확인할 수 있습니다.

Sources