nxnai/Voost
[SIGGRAPH Asia 25] Voost: A Unified and Scalable Diffusion Transformer for Bidirectional Virtual Try-On and Try-Off
What it solves
Voost는 가상 착용(사람에게 옷을 추가)과 가상 탈의(사람에게서 옷을 제거) 모두를 단일 통합 모델에서 처리하도록 설계되었습니다. 다양한 인간 포즈, 옷 종류, 배경 및 조명 조건에서도 고품질의 사실적인 결과를 제공하는 것을 목표로 합니다.
How it works
Voost는 확장 가능한 Diffusion Transformer(DiT) 아키텍처를 활용하여 양방향 이미지 조작을 수행합니다. 이를 통해 모델은 동일한 트랜스포머 프레임워크 내에서 옷을 추가하거나 제거하는 작업을 공동으로 관리하여 다양한 이미지 구성을 통해 일관성과 품질을 보장합니다.
Who it’s for
이 프로젝트는 컴퓨터 비전, 디지털 패션 및 AI 기반 이미지 편집에 종사하는 연구자와 개발자를 대상으로 하며, 특히 가상 착용 및 탈의 기술에 초점을 맞춘 사람들을 위한 것입니다.
Highlights
- 가상 착용과 탈의를 모두 지원하는 통합 프레임워크.
- 확장 가능한 Diffusion Transformer 아키텍처 기반.
- 인간 포즈, 옷 카테고리 및 조명 변화에 강인함.
- Hugging Face Spaces에서 공개 데모 제공.