Qwen-Image-Layered:層次分解以實現內在可編輯性
Qwen-Image-Layered 是一個能將單張圖像分解為多個 RGBA 層的模型,透過實體分離語意或結構元件來實現內在的可編輯性。此方法使用戶能獨立操作特定層,確保高保真度的編輯以及其餘圖像內容的一致性。
層次分解與圖像編輯
Qwen-Image-Layered 透過將圖像拆分為獨立的 RGBA 層,將點陣圖轉換為結構化表示。這種元件的實體分離允許精確的編輯操作,僅對目標層進行變更,其他內容保持不變。
此層次化表示啟用的主要功能包括:
- 重新著色: 在不影響圖像其他部分的情況下,變更特定層的顏色。
- 物件替換: 替換特定層(例如,將女孩換成男孩),同時保留背景與其他元素。
- 文字修訂: 在特定層內修改文字。
- 物件移除: 透過移除相應層,乾淨地刪除不需要的物件。
- 縮放與重新定位: 在不產生失真情況下縮放物件,或在畫布內自由移動物件。
靈活且可迭代的分解
該模型不依賴固定層數,提供圖像結構上的彈性。Qwen-Image-Layered 支援可變層數的分解,意味著使用者可根據任務的具體需求,將圖像分解為不同數量的層(例如 3 層或 8 層)。
此外,模型支援遞迴分解。從初始分解產生的任何單一層都可以進一步分解為更多層,實現無限分解的過程,以對圖像元素進行更細緻的控制。
技術意涵
透過彌合點陣圖與結構化、可編輯表示之間的鴻溝,Qwen-Image-Layered 從傳統的全局圖像編輯轉向可組合的框架。這確保了基本操作(例如縮放與重新定位)仍保持高保真度與一致性,因為結構元件已被實體分離。