nv-tlabs/lyra

Project Lyra: Open Generative 3D World Models

What it solves

Project Lyra는 제한된 시각적 입력으로부터 3D 및 4D 장면을 생성하는 방법을 제공합니다. 단일 이미지 또는 비디오에서 일관성 있고 탐색 가능한 3D 월드를 구축하는 과제를 해결하며, 2D 생성형 AI에서 공간적으로 일관된 3D 환경으로의 전환을를 가능하게 합니다.

How it works

이 프로젝트는 두 가지 주요 버전으로 구성됩니다:

  • Lyra 1.0: 비디오 확산 모델 자기 증류(self-distillation)를 사용하여 단일 이미지 또는 비디오로부터 피드포워드 방식의 3D 및 4D 장면 생성을 가능하게 합니다.
  • Lyra 2.0: 장기적인 3D 일관성 생성을 통해 탐색 가능한 생성형 3D 월드를 구축하는 데 중점을 둡니다.

Who it’s for

이 기술은 3D 장면 재구성, 생성형 AI 및 가상 환경 구축 분야에서 연구원과 개발자를 위해 설계되었습니다.

Highlights

  • 3D/4D Generation: 단일 이미지 또는 비디오에서 3D 장면 및 4D (time-varying) 장면을 생성할 수 있습니다.

  • 3D Consistency: Lyra 2.0는 특히 장기적인 일관성을 목표로 하여, 탐색 중에도 월드가 안정적으로 유지되도록 합니다.

  • 3D Consistency: Lyra 2.0는 특히 장기적인 일관성을 목표로 하여, 탐색 중

  • Open Implementation: Lyra 2.0를 위한 공식 구현체, 학습 코드를 제공합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트