saddam213/AmuseAI

Local AI image, video, audio and text.

解決的問題

Amuse 提供統一的本地介面,用於生成與編輯 AI 驅動的多媒體內容,無需再分別管理圖像、影片、音訊與文字生成的多個獨立工具。

工作原理

基於 .NET 10 建構,此應用程式整合了多種 AI 管道(如 FLUX、StableDiffusion、Qwen 和 Whisper),並支援多種 GPU 後端,包括 Nvidia 的 CUDA 以及適用於 AMD、Nvidia、Intel 等多廠牌相容的 Vulkan。支援 Safetensors、GGUF 與 ONNX 等多種模型格式。

適用對象

希望在不同 GPU 品牌的個人硬體上,本地運行全面生成式 AI 工具套件的使用者。

主要亮點

  • 多模態生成:支援圖像、影片、音訊與文字的廣泛管道。
  • 進階媒體工具:內建影片編輯器、圖像/影片超解析度、圖像修復(inpainting)與插值功能。
  • 硬體彈性:相容 Nvidia(CUDA)及其他 GPU 透過 Vulkan 實現。
  • 控制工具:支援 Lora 與 ControlNet,實現對輸出的精確控制。

相關

  • 專案
  • 專案
  • 專案
  • 專案