techjarves/Portable-Local-Studio

Portable local AI studio for Windows, Linux, and macOS. Zero-setup GUI for Image Generation, GGUF LLMs, Text to Speech & Speech to Text

何を解決するか

ポータブルAIスタジオは、単一のマシン上で複数のAIモダリティを実行するためのゼロ構成、100%オフライン環境を提供します。複雑な環境設定やクラウドサブスクリプション、インターネット接続の必要性を排除し、ユーザーが自らのハードウェア上で画像生成、LLMチャット、音声処理をプライベートに実行できるようにします。

動作方法

このプロジェクトは、高性能なC++バックエンドを複数統合し、自己完結型のランタイムとしてバンドルしています。WebベースのGUIでこれらのエンジンを管理しており、デフォルトでは互いに排他的に動作することでVRAMおよびRAMの使用を最適化します。自動的にハードウェアを検出し、利用可能な最適な加速方法を適用します:

  • 画像生成: stable-diffusion.cpp で実装。CUDA、ROCm、Vulkan、Metal、OpenVINOをサポート。
  • テキストチャット: llama.cpp でGGUFモデルを処理。
  • 音声認識: whisper.cpp で実装。
  • 音声合成: kokoro-js とKokoro-82M ONNXモデルを使用。

対象ユーザー

Windows、Linux、macOS(Apple Silicon)ユーザーで、Python環境やAPIキーの管理をせずにプライベートで制限のないAIスタジオを利用したい方を対象としています。

特徴

  • ゼロインストールのポータビリティ: グローバルシステムの変更を避けるために、独自のNode.jsランタイムと事前コンパイル済みバイナリを含んでいます。
  • マルチモーダル統合: 画像生成、LLMチャット、音声認識、音声合成を1つのインターフェースで統合しています。
  • ハードウェア自動検出: Nvidia(CUDA)、AMD(ROCm/Vulkan)、Intel(Vulkan/OpenVINO NPU)、Apple(Metal)など、幅広いアクセラレータをサポートしています。
  • 統合モデルマネージャー: Hugging FaceのURL経由またはローカルのドラッグアンドドロップで重みをインポートできます。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト