Grok 이미지 생성 릴리스
xAI는 Grok에 통합된 새로운 자기회귀 이미지 생성 모델인 Aurora를 발표했습니다. 이번 업데이트로 Grok은 텍스트 지시사항을 엄격히 따르며 사실적인 렌더링에 중점을 둔 고품질 이미지를 생성할 수 있게 되었으며, 이미지 간 편집을 위한 내장된 다중모달 지원 기능도 추가되었습니다.
Aurora 모델 아키텍처 및 훈련
Aurora는 자기회귀 혼합 전문가(MoE) 네트워크로 구축되었습니다. 이 모델은 텍스트와 이미지를 번갈아가며 입력하는 데이터로부터 다음 토큰을 예측하도록 설계되었습니다. 세계에 대한 깊은 이해와 높은 품질의 렌더링을 달성하기 위해 xAI는 인터넷에서 수집한 수십억 개의 예제를 기반으로 Aurora를 훈련시켰습니다.
핵심 이미지 생성 기능
Aurora는 기존 이미지 생성 모델이 어려움을 겪는 여러 분야에서 고품질 이미지를 생성할 수 있도록 Grok의 능력을 확장합니다. 주요 기능은 다음과 같습니다:
- 현실 세계 엔티티 렌더링: 현실 세계의 객체와 엔티티에 대한 정밀한 시각적 세부 정보.
- 텍스트 및 로고 통합: 이미지 내 정확한 텍스트와 로고 렌더링 기능.
- 인간 초상화 생성: 인간과 유명인의 사실적인 초상화 생성.
- 다양한 콘텐츠 유형 지원: 사실적인 풍경과 사이버펑크 도시에서부터 예술적 스케치, 만화 스타일 일러스트까지 다양한 스타일 지원.
다중모달 입력 및 이미지 편집
텍스트에서 이미지 생성 외에도 Aurora는 내장된 다중모달 입력 지원 기능을 갖추고 있습니다. 이를 통해 사용자가 제공한 이미지를 영감의 근거 또는 직접 편집 대상으로 활용할 수 있습니다. 예를 들어, 고양이 이미지를 제공하고 "고양이를 애니메이션 스타일로 바꿔줘"라고 지시하면 원본 이미지의 스타일이 변형된 버전이 생성됩니다.
사용 가능 및 배포
2024년 12월 9일 기준, 이러한 이미지 생성 기능은 일부 국가의 ¹ 플랫폼에서 이용 가능합니다. xAI는 이 기능이 발표 후 일주일 이내에 모든 사용자에게 점차 제공될 예정이라고 밝혔습니다.
Sources
- OriginalGrok Image Generation Release
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch