qualcomm/GenieX
Run frontier LLMs and VLMs locally on Qualcomm devices across NPU, GPU, and CPU with a few lines of code
What it solves
GenieX は、Qualcomm Snapdragon デバイス上で最先端の大規模言語モデル(LLM)およびビジョン言語モデル(VLM)をローカルで実行するプロセスを簡素化します。Hexagon NPU、Adreno GPU、CPU のいずれかを活用できる統一インターフェースを提供することで、特定ハードウェア向けの複雑な実装を排除します。
How it works
GenieX は推論ランタイムとして機能し、2 つの異なるバックエンドをラップします:Hugging Face の GGUF モデルに広く対応する llama.cpp と、Qualcomm AI Hub から提供される最適化済みの事前コンパイルバンドルを利用する Qualcomm AI Engine Direct(qairt)。単一の C SDK を提供し、CLI、Python ライブラリ、Android 用 Kotlin/Java、Docker、OpenAI 互換サーバーなど、複数のハイレベルインターフェースで利用可能です。
Who it’s for
Windows ARM64(Snapdragon X/X Elite)、Android(Snapdragon 8 Elite)、Linux ARM64(IoT)デバイス向けに AI アプリケーションを構築し、ローカルでモデルを実行したいが低レベルハードウェアコードを書きたくない開発者向けです。
Highlights
- Multi-Backend Support:柔軟性のための GGUF モデルと、NPU の最高性能を引き出す事前コンパイルバンドルを切り替え可能。
- Broad Interface Options:Python(Hugging Face transformers と同様)、CLI、Android SDK、または即座に使用できる OpenAI 互換 API サーバーでアクセス可能。
- Cross-Platform:Windows ARM64、Android、Linux ARM64 をサポート。
- Hardware Acceleration:Hexagon NPU、Adreno GPU、CPU へ直接アクセス。