Gemini Omni 1.1 Flash 릴리스 노트 / 새 기능 소개

Google DeepMind는 프로페셔널 사용을 위한 생성형 비디오 제작을 가능하게 하는 생성형 비디오 기능과 창의적 제어 기능을 갖춘 Gemini Omni 1.1 Flash를 발표했습니다. Google AI Studio를 통해 Gemini API를 통해 이용 가능하며, 개발자가 미디어 편집 소프트웨어 및 창의적 도구를 개발할 때 제어력, 반복 속도, 출력 품질을 향상시키는 데 중점을 두고 있습니다.

내러티브 일관성을 위한 개선된 장면 확장

Gemini Omni 1.1 Flash는 기존 비디오 자료를 원활하게 확장할 수 있도록 합니다. 이 모델은 이전 모델이 마지막 1초만 참조한 것과 달리, 최대 10초의 이전 컨텍스트를 분석할 수 있어 시각적 일관성과 내러티브 적합성을 향상시킵니다.

비디오는 10초 단위로 확장 가능하며, 누적 길이가 최대 40초까지 가능합니다.

프레임 보간을 통한 정밀한 움직임 제어

Omni 1.1은 장면의 시작 프레임과 끝 프레임을 명시할 수 있게 합니다. 모델은 두 키프레임 사이의 연속된 비디오를 생성하여, 복잡한 카메라 궤도, 줌 전환, 점프 컷 없이 자연스러운 루프 클립 생성을 가능하게 합니다.

360p 드래프트를 통한 최적화된 프로토타이핑

반복 프로세스를 가속화하기 위해 Omni 1.1은 360p 해상도의 가벼운 미리보기를 생성할 수 있습니다. 이러한 드래프트는 표준 720p 해상도보다 최대 60% 빠르게 생성되며, 비용은 3분의 1에 불과하여 빠른 프로토타이핑과 스토리보드 반복에 적합합니다.

프로페셔널 해상도 및 업스케일링

Omni 1.1은 프로페셔널 제작에 적합한 고해상도 출력을 지원하며, 비디오를 1080p 또는 4K 해상도로 업스케일링할 수 있습니다.

다중모달 비디오 참조

개발자는 이제 다중모달 입력의 일부로 최대 3초의 비디오를 포함할 수 있습니다. 이를 통해 업로드된 비디오 파일에서 특정 움직임이나 장면을 참조함으로써 캐릭터 일관성과 시각적 맥락을 유지할 수 있습니다.

이용 가능 및 통합

Gemini Omni 1.1 Flash는 여러 Google 플랫폼을 통해 이용 가능합니다:

  • Google AI Studio: 직접 접근을 통해 빌드 및 테스트 가능.
  • Gemini Enterprise Agent Platform: 기업 개발자를 위한 배포 옵션.
  • Google Flow: Google AI Plus, Pro, Ultra 구독자에게 제공.
  • Gemini App: 전 세계의 Google AI Plus, Pro, Ultra 구독자에게 장면 확장 기능 제공.

Sources

관련

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch