saddam213/AmuseAI
Local AI image, video, audio and text.
何を解決するか
Amuseは、画像、動画、音声、テキスト生成に必要な複数の個別ツールを管理する必要なく、AI駆動メディアの生成と編集を統合されたローカルインターフェースで行えるようにします。
動作方法
.NET 10に基づいて構築されたアプリケーションは、FLUX、StableDiffusion、Qwen、WhisperなどのさまざまなAIパイプラインを統合し、Nvidia用のCUDAおよびAMD、Nvidia、Intel向けのクロスベンダ互換性を備えたVulkanなど、複数のGPUバックエンドをサポートします。Safetensors、GGUF、ONNXなどのさまざまなモデル形式もサポートしています。
対象ユーザー
異なるGPUブランドの自宅ハードウェア上で、包括的な生成AIツールスイートをローカルで実行したいユーザー向けです。
特徴
- マルチモーダル生成: 画像、動画、音声、テキスト用の幅広いパイプラインをサポート。
- 高度なメディアツール: 内蔵の動画エディタ、画像/動画の拡大、インペインティング、補間機能を備えています。
- ハードウェアの柔軟性: Nvidia (CUDA) およびVulkanを介した他のGPUと互換性があります。
- 制御ツール: 出力の正確な制御にLoraとControlNetをサポート。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト