jegly/Box
The most advanced, fully offline client-side AI suite on Android today.
What it solves
Box は、プライバシーとオフライン機能を確保しながら、さまざまな AI モデルをデバイス上で実行できる、セキュリティ強化された機能豊富な Android アプリです。ローカル AI の包括的ハブとして、テキスト生成、画像生成、音声認識、音声合成、コンピュータビジョンのツールを、ネットワーク接続なしで提供します。
How it works
Google AI Edge Gallery のフォークとして構築された Box は、LiteRT と llama.cpp を組み合わせたハイブリッドエンジンを使用し、幅広いモデルを実行します。GGUF モデルのインポートに対応し、Google Tensor(TPU)、Snapdragon、MediaTek NPU など、さまざまなモバイルチップセットでハードウェアアクセラレーションを活用します。アプリは、モデル管理やチャット、画像アップスケーリング、音声インタラクションなどのタスク用の専用インターフェースを提供します。
Who it’s for
プライバシーとセキュリティを重視する Android ユーザー(GrapheneOS や LineageOS などのカスタム ROM ユーザーを含む)や、モバイルデバイス上で強力なマルチモーダル AI モデルをローカル実行したい AI 愛好家向けです。
Highlights
- マルチモーダル機能: テキスト LLM(Gemma、Qwen、Phi)、画像生成、画像アップスケーリング(超解像)、デバイス上での音楽/サウンド生成をサポート。
- ハードウェアアクセラレーション: Snapdragon、MediaTek、Google Tensor(TPU)向けの専用 NPU サポートでローカル推論を高速化。
- プライバシーとセキュリティ: 生体認証ロック、SQLCipher による暗号化チャット履歴、そして「ハードオフライン」モードを搭載。
- ボイスモード: SenseVoice(STT)と Supertonic(TTS)を使用した音声‑to‑音声 AI チャットを統合。
- ビジョン AI: デバイス上での画像認識、暗号化された顔認識、ポーズやフェイスメッシュ検出のためのビジュアルオーバーレイを提供。
- ドキュメント解析: PDF やテキストファイルをローカルで解析可能。
- 拡張性: llama.cpp と GGUF モデルのインポートをサポートし、ユーザーが独自モデルを持ち込めます。