saddam213/AmuseAI

Local AI image, video, audio and text.

何を解決するか

Amuseは、画像、動画、音声、テキスト生成に必要な複数の個別ツールを管理する必要なく、AI駆動メディアの生成と編集を統合されたローカルインターフェースで行えるようにします。

動作方法

.NET 10に基づいて構築されたアプリケーションは、FLUX、StableDiffusion、Qwen、WhisperなどのさまざまなAIパイプラインを統合し、Nvidia用のCUDAおよびAMD、Nvidia、Intel向けのクロスベンダ互換性を備えたVulkanなど、複数のGPUバックエンドをサポートします。Safetensors、GGUF、ONNXなどのさまざまなモデル形式もサポートしています。

対象ユーザー

異なるGPUブランドの自宅ハードウェア上で、包括的な生成AIツールスイートをローカルで実行したいユーザー向けです。

特徴

  • マルチモーダル生成: 画像、動画、音声、テキスト用の幅広いパイプラインをサポート。
  • 高度なメディアツール: 内蔵の動画エディタ、画像/動画の拡大、インペインティング、補間機能を備えています。
  • ハードウェアの柔軟性: Nvidia (CUDA) およびVulkanを介した他のGPUと互換性があります。
  • 制御ツール: 出力の正確な制御にLoraとControlNetをサポート。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト