Anil-matcha/Open-Generative-AI
Unrestricted Open-source alternative to AI video platforms — Free AI image & video generation studio with 600+ models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.
해결하는 문제
오픈 생성형 AI는 폐쇄적인 AI 비디오 및 이미지 플랫폼에 대한 무료 오픈소스 대안을 제공합니다. 제한적인 콘텐츠 필터, 구독료 및 벤더 종속성을 제거하여 프롬프트 거부나 가드레일 없이 미디어를 생성할 수 있는 완전한 창작 자유를 사용자에게 제공합니다.
작동 방식
이 프로젝트는 호스팅된 웹 앱 또는 데스크톱 애플리케이션으로 사용할 수 있는 종합 스튜디오 인터페이스입니다. 14개의 전문 스튜디오(이미지, 비디오, 오디오, 립싱크 등)에 걸쳐 400개 이상의 최첨단 모델로 구성된 방대한 라이브러리에 연결됩니다.
로컬에서 모델을 실행하려는 사용자를 위해 데스크톱 앱에는 두 개의 추론 엔진이 포함되어 있습니다:
- sd.cpp: 이미지 모델(SD 1.5, SDXL, Z-Image)을 위한 번들 C++ 엔진으로 Mac에서는 Metal GPU를, Windows/Linux에서는 CUDA/Vulkan/ROCm을 지원합니다.
- Wan2GP: 사용자가 제공하는 Gradio 서버용 클라이언트로 NVIDIA/AMD GPU에서 무거운 비디오 모델(Wan 2.2, Hunyuan, LTX)과 대형 이미지 모델(Flux, Qwen-Image)을 실행합니다.
대상 사용자
고품질 AI 이미지, 비디오 및 오디오를 생성할 수 있는 무제한 환경을 원하는 크리에이터, 디자이너 및 AI 애호가와 자신의 창작 도구를 자체 호스팅하려는 사용자를 위해 설계되었습니다.
하이라이트
- 방대한 모델 라이브러리: 텍스트-이미지, 이미지-이미지, 텍스트-비디오 및 이미지-비디오를 위한 400개 이상의 모델에 대한 액세스.
- 전문 스튜디오: 립싱크, 시네마(프로 카메라 컨트롤 포함), 마케팅 및 AI 인플루언서 콘텐츠를 위한 전용 환경.
- 시각적 워크플로우: 여러 AI 모델을 자동화된 파이프라인으로 연결하는 노드 기반 워크플로우 스튜디오.
- 로컬 추론: 번들 엔진을 통해 자체 하드웨어에서 모델을 실행하여 데이터 프라이버시와 오프라인 액세스를 보장하는 기능.
- 다중 이미지 입력: 고급 편집 모델을 위해 최대 14개의 참조 이미지 지원.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트