ChatGPT 이미지 2.0 출시

OpenAI는 이미지 생성 시스템에 대한 주요 업데이트인 ChatGPT Images 2.0을 도입했습니다. 이 업데이트는 더 높은 정밀도, 정교한 스타일 제어, 그리고 다양한 전 세계 언어에 걸친 복잡한 텍스트 렌더링 기능을 제공합니다. 이번 릴리스는 단순 이미지 생성기를 연구·추론부터 다듬어진 최종 비주얼까지 전 과정의 자산을 만들 수 있는 시각적 사고 파트너로 변모시킵니다.

향상된 정밀도 및 기술 제어

ChatGPT Images 2.0은 복잡한 프롬프트를 따르고 구조적 제어를 유지하는 데 있어 훨씬 높은 정확성을 제공합니다. 이제 모델은 복잡한 레이아웃과 전문 인쇄 제작 가이드(여백, 트림, 안전 여백선 등)와 같은 구체적인 기술 요구 사항을 처리할 수 있습니다.

주요 기술 개선 사항은 다음과 같습니다:

  • 유연한 종횡비: 시스템은 넓은 파노라마 도시 풍경부터 세로형 모바일 화면, 표준 정사각형 이미지에 이르기까지 다양한 형식을 지원합니다.
  • 다중 장면 연속성: 모델은 여러 패널에 걸쳐 캐릭터와 서사의 일관성을 유지하는 능력을 보여주며, 이는 일관된 만화 페이지와 스토리텔링 시퀀스 생성에서 확인됩니다.
  • 복잡한 레이아웃: 헤드라인, 콜아웃, 지도, 통계가 포함된 잡지 스타일 인포그래픽 스프레드와 같은 구조화된 편집 콘텐츠를 생성할 수 있습니다.

다국어 텍스트 렌더링 및 전 세계 스크립트

버전 2.0의 가장 눈에 띄는 발전 중 하나는 다양한 전 세계 언어와 스크립트에서 가독성 높고 정확한 텍스트를 렌더링할 수 있는 능력입니다. 이는 이전의 라틴 문자 이외의 문자에 대한 제한을 없애고 다양한 지역을 위한 시장 준비 자산을 만들 수 있게 합니다.

지원되는 스크립트 및 언어 예시:

  • 동아시아 스크립트: 일본어, 중국어, 한국어(환대 브로셔용 고품질 한국어 타이포그래피 포함).
  • 남아시아 스크립트: 힌디어와 벵골어.
  • 기타 전 세계 스크립트: 아랍어, 데바나가리, 키릴 문자, 그리스어.

스타일리시한 정교함 및 사실감

ChatGPT Images 2.0은 시각 어휘를 확장하여 더 넓은 스타일 스펙트럼을 높은 충실도로 다룹니다. 모델은 구조적 무결성을 유지하면서 하이퍼 리얼리즘 사진과 고도로 스타일화된 아트 사이를 자유롭게 전환할 수 있습니다.

주목할 만한 스타일적 능력은 다음과 같습니다:

  • 사진적 사실감: 모델은 영화 같은 솔직 초상, 야간 플래시 사진(필름 카메라 스냅샷 시뮬레이션), 다큐멘터리 스타일 35mm 흑백 사진을 제작할 수 있습니다.
  • 일러스트 스타일: 다양한 만화 스타일(소년·청년 만화 포함), 인디 코믹, 아동 도서 일러스트에 높은 숙련도를 보입니다.
  • 그래픽 디자인: 대담한 타이포그래피와 기하학적 형태를 활용한 바우하우스 영감 포스터, 아르 데코 디자인, 현대주의 편집 레이아웃을 만들 수 있습니다.

시각적 추론 및 인텔리전스

미학적 개선을 넘어, ChatGPT Images 2.0은 "생각 모드"를 통합하여 시각적 사고 파트너 역할을 합니다. 이를 통해 모델은 요청을 논리적으로 분석하고 원본 자료를 다듬어진 비주얼로 변환합니다.

이 통합 인텔리전스의 예시:

  • 교육용 시각화: 복잡한 수학 증명(예: 칸토어 대각선 증명) 및 추상 정보를 명확한 시각적 설명으로 전환하는 교육용 레이아웃을 생성합니다.
  • 연구 번역: 원본 GPT-1 논문과 같은 방대한 연구 논문을 접근하기 쉬운 컨퍼런스 스타일 인포그래픽으로 변환합니다.
  • 맥락 정확성: 최신 지식과 검색 기능을 활용해 현재 실제 정보를 기반으로 정확한 제품 목업을 생성합니다.

Sources