SaladTechnologies/comfyui-api
A simple API server to make ComfyUI easy to scale horizontally. Get outputs directly in the response, or asynchronously via a variety of storage providers.
解决的问题
ComfyUI API 将 ComfyUI 从一个本地的、有状态的 GUI 工具转变为无状态的、可扩展的 API 服务器。这使得开发者无需管理底层 ComfyUI 的状态或手动处理文件,即可将强大的生成式 AI 工作流(图像和视频生成)集成到更大的应用程序中。
工作原理
该项目作为 ComfyUI /prompt API 的封装器。它通过下载所需输入媒体、执行工作流,然后交付输出来管理请求的生命周期。支持两种主要操作模式:
- 同步模式: 直接在 HTTP 响应中返回 base64 编码的图像。
- 异步模式: 将完成的输出发送到指定的 webhook URL 或上传到云存储。
它还包含动态模型加载、用于本地存储管理的 LRU 缓存,以及通过启动清单自动安装模型和扩展的功能。
适用人群
希望将 ComfyUI 工作流作为可扩展微服务部署的开发者和机器学习工程师,特别是使用 Kubernetes 或 SaladCloud 等容器化环境的用户。
主要亮点
- 无状态架构: 可在负载均衡器后实现水平扩展。
- 灵活的输出交付: 支持 base64 响应、webhook 和模块化存储后端(S3、Azure Blob、Hugging Face、HTTP)。
- 广泛模型支持: 已验证支持 Stable Diffusion(1.5、XL、3.5)、Flux、AnimateDiff 以及 Hunyuan、CogVideoX、Mochi 等多种视频模型。
- 动态模型加载: 自动缓存通过 URL 提供的模型(在模型加载节点中)。
- 可自定义图像处理: 通过 API 参数可返回 PNG、JPEG 或 WebP 格式的图像。
- 单二进制分发: 以单个二进制文件形式分发,无需外部依赖,便于部署。
相关
- 项目
- 项目
- 项目
- 项目
- 项目