dineshsoudagar/local-llms-on-android
Run local LLMs like Gemma, Qwen, and LLaMA on Android for offline, private, real-time chat and question answering with LiteRT and ONNX Runtime.
何を解決するか
Androidデバイス上で完全にオフラインで大規模言語モデル(LLM)を実行する方法を提供し、ユーザーのプライバシーとオフライン利用を保証します。クラウドベースのAIに依存することなく、ユーザーがスマートフォン上でモデルを直接ダウンロード、切り替え、管理できるようにします。
動作方法
アプリは小さなベースAPKを使用し、インストール後に特定のモデルウェイト(例:QwenやGemma)をダウンロードできます。ONNXおよびLiteRTバックエンドを活用して、対応デバイスでのGPUおよびNPUによるハードウェアアクセラレーションを実現し、遅延を低減します。テキスト、音声、画像(OCRまたはネイティブ画像対応)など、複数の入力モダリティをサポートしています。
対象ユーザー
低スペックからフラッグシップまで、さまざまなハードウェア上で動作するプライベートでオフラインのAIアシスタントを必要とするAndroidユーザー。
特徴
- 完全にデバイス内処理:初期モデルダウンロード後、すべての推論、OCR、画像処理がオフラインで行われます。
- 柔軟なモデル管理:ユーザーは複数のモデル(例:Gemma 4、Qwen 3)をダウンロード、切り替え、削除してデバイスストレージを管理できます。
- マルチモーダル入力:音声プロンプト、カメラ撮影(クロッピング対応)、OCRまたはネイティブGemma画像対応による画像入力をサポートします。
- ハードウェア最適化:GPUおよびNPUアクセラレーションにより、速度を向上させ、遅延を低減するためLiteRTを使用しています。
- カスタマイズ可能:編集可能なモデル指示、プリセット、UIテーマ(ダーク/ライトモード)を備えています。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト