ChatGPT Images와 GPT Image 1.5 출시
OpenAI는 새로운 flagship 이미지 생성 모델로 구동되는 ChatGPT Images의 새로운 버전을 출시했습니다. 이 업데이트는 생성 속도, 정밀 편집, 지시 사항 따르기에서 상당한 개선을 도입하여 사용자가 반복 과정에서 일관된 세부 사항을 유지하면서 이미지를 생성하고 수정할 수 있게 합니다.
정밀 이미지 편집 및 보존
GPT Image 1.5는 업로드된 이미지에 대해 더 신뢰할 수 있는 편집을 허용하여, 요청된 위치에서만 변경이 발생하도록 하면서 조명, 구성, 사람의 외모와 같은 필수 요소를 보존합니다. 이 기능은 보다 믿을 수 있는 의상 및 헤어스타일 시도, 실용적인 사진 편집, 그리고 원본 이미지의 essence를 유지하는 개념적 변형을 가능하게 합니다.
편집 기능
이 모델은 이미지 내에서 요소의 추가, 빼기, 결합, 혼합, 전치에서 뛰어납니다. 예를 들어, 사용자는 서로 다른 이미지의 여러 주제를 하나의 장면으로 결합하거나 특정 요소의 스타일을 변경할 수 있습니다(예: 사람을 레트로 애니메이션 스타일로 변경)하면서 이미지의 다른 부분은 그대로 유지할 수 있습니다.
창의적 변형
이 모델은 사진을 특정 텍스트 및 레이아웃 변경이 적용된 영화 포스터로 변환하는 것과 같은 복잡한 변형을 수행할 수 있으며, 이때 대상의 likeness를 유지합니다. 이러한 변형은 텍스트 프롬프트를 통해 또는 새로운 Images 기능의 사전 설정 스타일을 통해 트리거될 수 있습니다.
지시 사항 따르기 및 텍스트 렌더링
초기 버전보다 지시 사항 따르기가 향상되어 더 복잡한 원본 구성을 가능하게 하고 요소 간의 관계 보존이 개선되었습니다. 또한, 이 모델은 더 dense하고 작은 텍스트 렌더링에서 발전하여 정확한 서식과 숫자를 갖춘 현실적인 신문 기사나 인포그래픽을 생성할 수 있게 되었습니다.
새로운 전용 창작 공간
OpenAI는 ChatGPT 사이드바 내에 전용 Images 경험을 도입했습니다(모바일 앱과 chatgpt.com에서 이용 가능). 이 공간은 다음과 같이 창의적 탐색을 간소화하도록 설계되었습니다:
- 사전 설정 필터 및 프롬프트: 영감을 불러일으키는 정기적으로 업데이트된 수십 개의 필터 및 트렌딩 프롬프트
- 외모 업로드: 사용자의 외모를 한 번 업로드하면 매번 새로운 사진을 업로드하지 않고도 미래 창작물에 재사용할 수 있습니다.
- 병렬 생성: 다른 이미지가 여전히 진행 중인 동안 사용자는 새로운 이미지 생성을 계속하여 대기 시간을 줄일 수 있습니다.
성능 및 API 가용성
이미지는 이전 버전보다 최대 4배 빠르게 렌더링됩니다. OpenAI는 결과가 여전히 완벽하지 않으며 다국어 지원 및 여러 얼굴 처리와 같은 영역에서 개선의 여지가 있다고 언급하지만, 이 모델은 선명한 그래픽 및 premature cropping 방지에서 명확한 진전을 보입니다.
API에서의 GPT Image 1.5
개발자는 API를 통해 GPT Image 1.5 로 새로운 모델에 접근할 수 있습니다. 이 버전은 GPT Image 1보다 이미지 보존 및 편집이 더 강력하여 브랜드 작업, 로고 제작, 전자상거래 제품 카탈로그에 특히 유용합니다.
- 비용 절감: GPT Image 1과 비교하여 이미지 입력 및 출력이 이제 20% 더 저렴합니다.
- 산업 채택: Wix, Canva, Figma, Shutterstock과 같은 회사들이 이미 이 모델을 활용하고 있습니다.
가용성
새로운 ChatGPT Images 모델은 전 세계 모든 ChatGPT 사용자와 API에 점진적으로 출시되고 있습니다. 이전 버전의 ChatGPT Images는 맞춤 GPT로서 여전히 이용 가능합니다.
Sources
- OriginalThe new ChatGPT Images is here