fallenshock/FlowEdit

Official implementation of the paper: "FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models"

它解決了什麼問題

FlowEdit 提供了一種使用文字提示編輯圖像的方法,無需耗費計算資源的「反演」過程。使用者可以根據來源提示與目標提示,修改圖像的特定元素,同時保留原始圖像的結構,並套用所需的變更。

它如何運作

此專案利用預訓練的流模型(例如 Stable Diffusion 3 與 Flux)執行文字導向的編輯。透過避免許多編輯管線中常見的反演步驟,簡化了將圖像從來源描述轉換為目標描述的流程。

適用對象

從事生成式 AI 與圖像操作的研究人員與開發者,想要更快速、無需反演的文字引導圖像編輯方法。

重點特色

  • 無需反演:不需要透過反演程序找出圖像的噪聲潛在向量。
  • 廣泛模型支援:相容於包括 Stable Diffusion 3 與 Flux 在內的主要流式模型。
  • ComfyUI 整合:可透過社群實作在 Flux 與 HunyuanLoom 中使用。
  • 獲獎肯定:榮獲 ICCV 2025 最佳學生論文獎。