NVlabs/AnyFlow

Flow Map OPD for AnyStep Video Diffusion

해결하는 문제

기존의 희석된 동영상 확산 모델은 일반적으로 고정된 샘플링 단계 수에 묶여 있어, 다양한 계산 자원에 유연하게 대응할 수 없습니다. AnyFlow는 단일 모델이 임의의 단계 수를 사용하여 고품질의 동영상을 생성할 수 있도록 하여 이 문제를 해결합니다. 추가적인 단계가 늘어날수록 품질이 안정적으로 향상됩니다.

작동 방식

AnyFlow는 흐름 맵 기반의 동영상 확산 프레임워크입니다. 온폴리시 흐름 맵 희석을 활용하여 임의의 단계 생성을 가능하게 합니다. 이 프레임워크는 인과적 및 양방향 동영상 확산 아키텍처 모두와 호환되며, 1.3B에서 14B 파라미터까지 확장 가능합니다.

대상 사용자

추론 속도와 품질 간의 트레이드오프에서 유연성을 필요로 하는 동영상 생성 모델 연구자 및 개발자에게 적합합니다.

주요 특징

  • 임의의 단계 생성: 고정된 단계 수에 얽매이지 않고, 임의의 추론 예산에 적응 가능.
  • 다양한 작업 지원: 단일 인과 모델 내에서 텍스트-에서-동영상, 이미지-에서-동영상, 동영상-에서-동영상 생성을 모두 지원.
  • 아키텍처 독립성: 인과적 및 양방향 동영상 확산 모델 모두와 호환.
  • 확장성: 1.3B에서 14B 파라미터 규모에 걸쳐 검증됨.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트