saddam213/AmuseAI

Local AI image, video, audio and text.

해결하는 문제

Amuse는 이미지, 동영상, 오디오, 텍스트 생성을 위한 별도의 도구를 여러 개 관리할 필요 없이, AI 기반 미디어 생성 및 편집을 통합된 로컬 인터페이스로 제공합니다.

작동 방식

.NET 10 기반으로 개발된 애플리케이션은 FLUX, StableDiffusion, Qwen, Whisper 등의 다양한 AI 파이프라인을 통합하고, Nvidia용 CUDA 및 AMD, Nvidia, Intel 등 다양한 제조업체 간 호환성을 갖춘 Vulkan과 같은 여러 GPU 백엔드를 지원합니다. Safetensors, GGUF, ONNX 등의 다양한 모델 형식도 지원합니다.

대상 사용자

자신의 하드웨어에서 다양한 GPU 브랜드를 지원하는 포괄적인 생성형 AI 도구 세트를 로컬에서 실행하고자 하는 사용자에게 적합합니다.

주요 기능

  • 다중 모달 생성: 이미지, 동영상, 오디오, 텍스트용 다양한 파이프라인을 지원합니다.
  • 고급 미디어 도구: 내장된 동영상 편집기, 이미지/동영상 확대, 인페인팅, 보간 기능을 포함합니다.
  • 하드웨어 유연성: Nvidia (CUDA) 및 Vulkan을 통한 다른 GPU와 호환됩니다.
  • 제어 도구: 정밀한 출력 조정을 위한 Lora 및 ControlNet을 지원합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트