OpenAI gpt-image-1 API 릴리스

OpenAI는 API를 통해 사용할 수 있는 본래 다중모달 이미지 생성 모델인 gpt-image-1을 출시했습니다. 이번 릴리스를 통해 개발자와 기업은 고품질의 전문 등급 이미지 생성, 텍스트 렌더링 및 시각 편집 기능을 자체 애플리케이션에 직접 통합할 수 있습니다.

모델 기능 및 다재다능성

gpt-image-1은 ChatGPT 내 이미지 생성을 지원하는 동일한 모델입니다. 다양한 미적 스타일에 걸쳐 다재다능하도록 설계되었으며, 세계 지식을 활용하면서 맞춤 가이드라인을 충실히 따를 수 있습니다. 주요 기술적 기능은 다음과 같습니다:

  • 정확한 텍스트 렌더링: 모델은 생성된 이미지 내에 텍스트를 정확하게 렌더링할 수 있습니다.
  • 시각 편집: 모델은 고충실도 시각 편집을 지원하며, 대략적인 스케치를 정교한 그래픽 요소로 변환할 수 있습니다.
  • 다양한 스타일링: 다양한 미적 스타일을 실험하여 다양한 전문 및 소비자 요구에 맞출 수 있는 유연성을 제공합니다.

기업 통합 및 사용 사례

여러 선도 기업이 이미 gpt-image-1을 자체 창작 및 비즈니스 도구에 통합하고 있습니다:

  • Adobe: Firefly 및 Express 앱에 이미지 생성 기능을 통합하여 크리에이터에게 더 많은 미적 스타일 옵션을 제공합니다.
  • Canva: Canva AI와 Magic Studio 내에서 디자인 생성 및 편집에 gpt-image-1을 활용하는 방안을 모색하고 있으며, 특히 스케치를 그래픽 요소로 변환하는 데 중점을 두고 있습니다.
  • GoDaddy: GoDaddy Airo®를 통해 편집 가능한 로고, 배경 제거 및 브랜드 콘텐츠와 소셜 미디어 자산을 위한 전문 타이포그래피 생성 실험을 진행하고 있습니다.
  • HubSpot: 소셜 미디어, 이메일 마케팅 및 랜딩 페이지용 마케팅 및 영업 자료 생성 방안을 탐색하고 있습니다.
  • Instacart: 레시피와 쇼핑 리스트용 이미지 생성을 테스트하고 있습니다.
  • invideo: AI 비디오 제작에서 텍스트 생성 향상, 세밀한 편집 제어 및 고급 스타일 가이드를 위해 모델을 활용하고 있습니다.

안전 및 검토

gpt-image-1은 GPT-4o의 이미지 생성 기능과 동일한 안전 가드레일을 적용하며, 유해 이미지 생성에 대한 제한을 포함합니다. 모든 생성된 이미지에는 출처를 위한 C2PA 메타데이터가 포함됩니다.

API를 사용하는 개발자는 moderation 매개변수를 통해 검토 민감도를 제어할 수 있습니다:

  • auto (default): 표준 필터링.
  • low: 덜 제한적인 필터링.

OpenAI는 기본적으로 고객 API 데이터가 학습에 사용되지 않으며, 모든 입력 및 출력은 API 사용 정책의 적용을 받는다고 명시하고 있습니다.

가격 구조

gpt-image-1은 토큰당 가격이 책정되며, 텍스트 토큰과 이미지 토큰에 대해 별도의 요율이 적용됩니다:

토큰 유형 1백만 토큰당 가격
Text input tokens (prompt text) $5
Image input tokens (input images) $10
laage output tokens (generated images) $40

실제로는 저품질, 중간 품질, 고품질 정사각형 이미지 각각에 대해 생성된 이미지당 약 $0.02, $0.07, $0.19가 청구됩니다.

SUMMARY: OpenAI는 API를 통해 사용할 수 있는 본래 다중모달 이미지 생성 모델인 gpt-image-1을 출시했으며, 이를 통해 개발자는 전문 등급 이미지 생성 및 편집 기능을 자체 플랫폼에 통합할 수 있습니다.

TITLE: OpenAI gpt-image-1 API 릴리스

Sources