fallenshock/FlowEdit
Official implementation of the paper: "FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models"
解決する課題
FlowEdit は、テキストプロンプトを用いて画像を編集する方法を提供し、計算コストの高い「インバージョン」プロセスを必要としません。ユーザーはソースプロンプトとターゲットプロンプトに基づいて画像の特定要素を変更でき、元の画像構造を保ちつつ望む変更を適用できます。
仕組み
本プロジェクトは、事前学習済みフローモデル(Stable Diffusion 3 や Flux など)を利用してテキストベースの編集を行います。多くの編集パイプラインで一般的なインバージョンステップを回避することで、画像をソース記述からターゲット記述へ変換するプロセスを簡素化しています。
対象者
生成 AI と画像操作に取り組む研究者や開発者で、テキストガイドによる画像編集をより高速に、インバージョン不要で行いたい方。
ハイライト
- インバージョン不要:画像のノイズ潜在変数を求めるインバージョンプロセスが不要です。
- 幅広いモデルサポート:Stable Diffusion 3 や Flux を含む主要なフローベースモデルに対応。
- ComfyUI 連携:Flux と HunyuanLoom 用のコミュニティ実装で利用可能。
- 受賞歴:ICCV 2025 ベスト学生論文賞を受賞。