SaladTechnologies/comfyui-api

A simple API server to make ComfyUI easy to scale horizontally. Get outputs directly in the response, or asynchronously via a variety of storage providers.

解決的問題

ComfyUI API 將 ComfyUI 從一個本地的、有狀態的 GUI 工具轉變為無狀態、可擴展的 API 伺服器。這使得開發者無需管理底層 ComfyUI 的狀態或手動處理檔案,即可將強大的生成式 AI 工作流程(影像與影片生成)整合到更大的應用程式中。

工作原理

此專案作為 ComfyUI /prompt API 的封裝器。它透過下載所需輸入媒體、執行工作流程,然後交付輸出來管理請求的生命週期。支援兩種主要操作模式:

  • 同步模式: 直接在 HTTP 回應中返回 base64 編碼的影像。
  • 非同步模式: 將完成的輸出傳送至指定的 webhook URL 或上傳至雲端儲存。

它還包含動態模型載入、用於本地儲存管理的 LRU 快取,以及透過啟動清單自動安裝模型與擴充功能的功能。

適用對象

希望將 ComfyUI 工作流程作為可擴展微服務部署的開發者與機器學習工程師,特別是使用 Kubernetes 或 SaladCloud 等容器化環境的使用者。

主要亮點

  • 無狀態架構: 可在負載平衡器後實現水平擴展。
  • 彈性輸出交付: 支援 base64 回應、webhook 與模組化儲存後端(S3、Azure Blob、Hugging Face、HTTP)。
  • 廣泛模型支援: 已驗證支援 Stable Diffusion(1.5、XL、3.5)、Flux、AnimateDiff 以及 Hunyuan、CogVideoX、Mochi 等多種影片模型。
  • 動態模型載入: 自動快取透過 URL 提供的模型(於模型載入節點中)。
  • 可自訂影像處理: 透過 API 參數可返回 PNG、JPEG 或 WebP 格式的影像。
  • 單一二進位分發: 以單一二進位檔形式分發,無外部相依性,便於部署。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案