saddam213/AmuseAI

Local AI image, video, audio and text.

解决的问题

Amuse 提供了一个统一的本地界面,用于生成和编辑 AI 驱动的媒体内容,无需再分别管理图像、视频、音频和文本生成的多个独立工具。

工作原理

基于 .NET 10 构建,该应用程序集成了多种 AI 管道(如 FLUX、StableDiffusion、Qwen 和 Whisper),并支持多种 GPU 后端,包括 Nvidia 的 CUDA 以及适用于 AMD、Nvidia、Intel 等多厂商兼容的 Vulkan。它支持 Safetensors、GGUF 和 ONNX 等多种模型格式。

适用人群

希望在不同 GPU 品牌的个人硬件上本地运行全面生成式 AI 工具套件的用户。

主要亮点

  • 多模态生成:支持图像、视频、音频和文本的广泛管道。
  • 高级媒体工具:内置视频编辑器、图像/视频超分辨率、图像修复(inpainting)和插值功能。
  • 硬件灵活性:兼容 Nvidia(CUDA)及其他 GPU 通过 Vulkan 实现。
  • 控制工具:支持 Lora 和 ControlNet,实现对输出的精确控制。

相关

  • 项目
  • 项目
  • 项目
  • 项目