lemonade-sdk/llamacpp-rocm

Fresh builds of llama.cpp with AMD ROCm™ 7 acceleration

何を解決するか

ROCm™ 7 を使用して AMD GPU 向けに最適化された、事前にコンパイルされた llama.cpp のナイトリービルドを提供します。ユーザーが手動でソフトウェアをコンパイルする必要も、ROCm SDK を別途インストールする必要もありません。実行時ライブラリはすべて組み込み済みです。

動作方法

このプロジェクトは、自動化された GitHub Actions パイプラインを使用して、ROCm SDK(TheRock)および HIP API に対して llama.cpp をコンパイルします。RDNA2 から RDNA4、CDNA1/2 に至る幅広い AMD GPU アーキテクチャをターゲットとし、Windows および Ubuntu 向けのバイナリを生成します。

対象ユーザー

Radeon dGPU、Ryzen AI APU、Instinctアクセラレータを含む AMD GPU を搭載し、手動設定の複雑さを避けながら GGUF モデルを高パフォーマンス GPU 加速で実行したいユーザー。

特徴

  • 組み込み ROCm™ 7:バイナリを実行するには、別途 SDK をインストールする必要がありません。
  • 広範な AMD 対応:gfx1151、gfx1150、gfx120X、gfx110X、gfx103X、gfx90a、gfx908 など、複数のアーキテクチャをサポート。
  • クロスプラットフォーム:Windows および Ubuntu 向けのナイトリービルドを提供。
  • 自動化パイプライン:最新の先端的な推論エンジンビルドをユーザーに常に提供します。

関連

  • プロジェクト
  • Dispatch
  • プロジェクト
  • プロジェクト
  • プロジェクト