saddam213/AmuseAI
Local AI image, video, audio and text.
解決的問題
Amuse 提供統一的本地介面,用於生成與編輯 AI 驅動的多媒體內容,無需再分別管理圖像、影片、音訊與文字生成的多個獨立工具。
工作原理
基於 .NET 10 建構,此應用程式整合了多種 AI 管道(如 FLUX、StableDiffusion、Qwen 和 Whisper),並支援多種 GPU 後端,包括 Nvidia 的 CUDA 以及適用於 AMD、Nvidia、Intel 等多廠牌相容的 Vulkan。支援 Safetensors、GGUF 與 ONNX 等多種模型格式。
適用對象
希望在不同 GPU 品牌的個人硬體上,本地運行全面生成式 AI 工具套件的使用者。
主要亮點
- 多模態生成:支援圖像、影片、音訊與文字的廣泛管道。
- 進階媒體工具:內建影片編輯器、圖像/影片超解析度、圖像修復(inpainting)與插值功能。
- 硬體彈性:相容 Nvidia(CUDA)及其他 GPU 透過 Vulkan 實現。
- 控制工具:支援 Lora 與 ControlNet,實現對輸出的精確控制。
相關
- 專案
- 專案
- 專案
- 專案