saddam213/AmuseAI
Local AI image, video, audio and text.
解决的问题
Amuse 提供了一个统一的本地界面,用于生成和编辑 AI 驱动的媒体内容,无需再分别管理图像、视频、音频和文本生成的多个独立工具。
工作原理
基于 .NET 10 构建,该应用程序集成了多种 AI 管道(如 FLUX、StableDiffusion、Qwen 和 Whisper),并支持多种 GPU 后端,包括 Nvidia 的 CUDA 以及适用于 AMD、Nvidia、Intel 等多厂商兼容的 Vulkan。它支持 Safetensors、GGUF 和 ONNX 等多种模型格式。
适用人群
希望在不同 GPU 品牌的个人硬件上本地运行全面生成式 AI 工具套件的用户。
主要亮点
- 多模态生成:支持图像、视频、音频和文本的广泛管道。
- 高级媒体工具:内置视频编辑器、图像/视频超分辨率、图像修复(inpainting)和插值功能。
- 硬件灵活性:兼容 Nvidia(CUDA)及其他 GPU 通过 Vulkan 实现。
- 控制工具:支持 Lora 和 ControlNet,实现对输出的精确控制。
相关
- 项目
- 项目
- 项目
- 项目