jegly/Box

The most advanced, fully offline client-side AI suite on Android today.

What it solves

Box は、プライバシーとオフライン機能を確保しながら、さまざまな AI モデルをデバイス上で実行できる、セキュリティ強化された機能豊富な Android アプリです。ローカル AI の包括的ハブとして、テキスト生成、画像生成、音声認識、音声合成、コンピュータビジョンのツールを、ネットワーク接続なしで提供します。

How it works

Google AI Edge Gallery のフォークとして構築された Box は、LiteRT と llama.cpp を組み合わせたハイブリッドエンジンを使用し、幅広いモデルを実行します。GGUF モデルのインポートに対応し、Google Tensor(TPU)、Snapdragon、MediaTek NPU など、さまざまなモバイルチップセットでハードウェアアクセラレーションを活用します。アプリは、モデル管理やチャット、画像アップスケーリング、音声インタラクションなどのタスク用の専用インターフェースを提供します。

Who it’s for

プライバシーとセキュリティを重視する Android ユーザー(GrapheneOS や LineageOS などのカスタム ROM ユーザーを含む)や、モバイルデバイス上で強力なマルチモーダル AI モデルをローカル実行したい AI 愛好家向けです。

Highlights

  • マルチモーダル機能: テキスト LLM(Gemma、Qwen、Phi)、画像生成、画像アップスケーリング(超解像)、デバイス上での音楽/サウンド生成をサポート。
  • ハードウェアアクセラレーション: Snapdragon、MediaTek、Google Tensor(TPU)向けの専用 NPU サポートでローカル推論を高速化。
  • プライバシーとセキュリティ: 生体認証ロック、SQLCipher による暗号化チャット履歴、そして「ハードオフライン」モードを搭載。
  • ボイスモード: SenseVoice(STT)と Supertonic(TTS)を使用した音声‑to‑音声 AI チャットを統合。
  • ビジョン AI: デバイス上での画像認識、暗号化された顔認識、ポーズやフェイスメッシュ検出のためのビジュアルオーバーレイを提供。
  • ドキュメント解析: PDF やテキストファイルをローカルで解析可能。
  • 拡張性: llama.cpp と GGUF モデルのインポートをサポートし、ユーザーが独自モデルを持ち込めます。