zolotukhin/zinc
Zig INferenCe Engine — Local LLM inference on AMD GPUs and Apple Silicon
何を解決するか
ZINCは、幅広いコンシューマーGPU上でGGUFモデルを実行するために設計された、高性能なローカル推論エンジンです。特にROCmを使用するAMD Radeonハードウェア上で、既存のツール(例:llama.cpp)よりも高速な代替手段を提供することを目指しています。
動作方法
Zigで書かれたZINCは、単一のバイナリであり、コマンドラインインターフェース、ブラウザベースのチャットインターフェース、GGUFファイルのダウンロードおよび管理を行うモデルマネージャ、OpenAI互換APIサーバーを統合しています。Vulkan(AMD/Intel)、ROCm/HIP(AMD)、Metal(Apple Silicon)、CUDA(NVIDIA、実験的)など、複数のGPUバックエンドをサポートしています。
対象ユーザー
AMDまたはApple Silicon GPUを使用している開発者やAI愛好家で、自宅のハードウェア上でLLMを高パフォーマンスでローカルに実行したい人。
特徴
- 複数のGPUパス向けのネイティブカーネルによる高速GGUF推論。
- 他のアプリケーションへの簡単な統合を可能にするOpenAI互換API。
- 即時利用可能な統合モデルマネージャーとブラウザチャット。
- AMD、Intel、Apple、NVIDIA GPUにわたる広範なハードウェアサポート。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- Dispatch