fallenshock/FlowEdit
Official implementation of the paper: "FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models"
해결하는 문제
FlowEdit은 텍스트 프롬프트를 사용해 이미지를 편집하는 방법을 제공하며, 계산 비용이 높은 "인버전" 과정을 요구하지 않습니다. 사용자는 소스 프롬프트와 타깃 프롬프트를 기반으로 이미지의 특정 요소를 수정할 수 있으며, 원본 이미지의 구조를 유지하면서 원하는 변화를 적용할 수 있습니다.
작동 원리
이 프로젝트는 사전 학습된 흐름 모델(예: Stable Diffusion 3 및 Flux)을 활용해 텍스트 기반 편집을 수행합니다. 많은 편집 파이프라인에서 일반적으로 사용되는 인버전 단계를 생략함으로써, 이미지를 소스 설명에서 타깃 설명으로 변환하는 과정을 간소화합니다.
대상
생성 AI와 이미지 조작을 연구·개발하는 연구원 및 개발자로, 텍스트 기반 이미지 편집을 더 빠르고 인버전 없이 수행하고자 하는 분들을 위한 도구입니다.
주요 특징
- 인버전 불필요: 이미지의 노이즈 잠재 변수를 찾는 인버전 과정이 필요 없습니다.
- 광범위한 모델 지원: Stable Diffusion 3 및 Flux를 포함한 주요 흐름 기반 모델과 호환됩니다.
- ComfyUI 통합: Flux와 HunyuanLoom용 커뮤니티 구현을 통해 이용 가능.
- 수상 경력: ICCV 2025 최우수 학생 논문상을 수상했습니다.