Sygil-Dev/sygil-webui

Stable Diffusion web UI

解決的問題

Sygil-WebUI 提供 Stable Diffusion 的瀏覽器介面,讓使用者無需撰寫程式碼,即可輕鬆生成圖像、編輯圖像,並管理底層的 AI 模型。

運作方式

它作為 Stable Diffusion 潛在空間文字轉圖像擴散模型的圖形使用者介面(GUI)。提供兩種主要介面:現代的 Streamlit 基礎 UI 與舊版的 Gradio 基礎 UI。系統整合了多種取樣器(如 K-Diffusion)、圖像增強工具與提示工程工具,讓使用者能透過瀏覽器與擴散過程互動。

適用對象

數位藝術家、AI 藝術愛好者,以及使用不同 GPU 硬體的使用者,包含低階 GPU 用戶(已在 4GB VRAM 上測試通過)。

主要特色

  • VRAM 優化: 優化模式可在僅 4GB VRAM 的 GPU 上實現 512x512 的圖像生成。
  • 進階提示功能: 支援提示權重、負向提示,以及用於產生多組提示組合的提示矩陣。
  • 圖像增強: 內建 GFPGAN 用於臉部修復,RealESRGAN 用於圖像放大。
  • 創意工具: 包含 img2img 的迴圈反饋功能、用於修復的蒙版繪製功能,以及用於圖像轉文字的 CLIP Interrogator。
  • 模型管理: 支援文字反轉訓練與自訂嵌入的使用。
  • 動態預覽: 在圖像生成過程中提供即時預覽。

相關

  • 專案
  • 專案
  • 專案
  • Dispatch
  • 專案