jegly/Box

The most advanced, fully offline client-side AI suite on Android today.

什麼是 Box

Box 是一款 Android 應用程式,將大量本地 AI 功能帶入手機。它最初是 Google 的 AI Edge Gallery 的分支,後來發展成功能豐富、安全性強的套件,可在本地運行,無需網路連接。


核心理念

  • 本地推論 – 所有模型(大型語言模型、視覺模型、擴散生成器、語音轉文字、文字轉語音等)都儲存在手機的 CPU、GPU 或專用 NPU(如 Snapdragon、Google Tensor、MediaTek 等)上執行。
  • 隱私優先 – 不需要連接雲端;聊天記錄會加密,可使用生物辨識鎖保護應用程式,並移除了 Google 所擁有的追蹤資料(Firebase、Clearcut)。
  • 一站式 AI 工具箱 – 應用程式整合了數十種模型,支援聊天、圖像生成、圖像超解析、文件分析、人臉辨識、音樂生成、多語言語音,以及為視力障礙使用者設計的語音相機助手。

主要功能(如 README 所列)

類別 亮點
LLM 聊天 支援透過 llama.cpp 的 GGUF 格式模型;包含混合注意力模型(如 Qwen 3.5‑0.8B)、專注推理的模型(Phi‑4‑mini‑reasoning),以及大型多模態模型(Gemma‑4‑12B)。在硬體允許的情況下,支援 LiteRT 和 Vulkan 的 GPU 加速。
視覺與多模態 「問圖像」功能,搭配 SmolVLM2、InternVL3 和基於 Gemini 的視覺模型。Box Assist 提供語音相機協助(物件描述、讀取收據、障礙物警示),協助視力障礙或低視力使用者。
圖像生成 本地擴散模型:Bonsai Image 4B(FLUX.2 klein)、FLUX 2 klein、Z‑Image Turbo。圖像完全離線生成;可選用 EDSR ×4 進行超解析。
音訊 語音轉語音聊天(語音模式)、多語言 STT(透過 SenseVoice)、本地 TTS(Supertonic),以及音樂/音效生成。
文件分析 支援 PDF/TXT 輸入、OCR、去模糊、去雜訊、掃描頁面扁平化、人像素描轉換。
增強功能 超解析、人臉辨識、照片擦除/修補、生物辨識鎖、加密 SQLite(SQLCipher)、防點擊竊取保護、僅限離線運作。
硬體加速 LiteRT 引擎支援 NPU(Snapdragon 8 Gen 2/3/Elite、Google Tensor G5/G6、MediaTek),Vulkan GPU 運算支援 GGUF 模型,並支援 CPU 備援。
國際化 UI 支援英文、法文、葡萄牙文(巴西)、德文、簡體中文;多語言語音模型支援 24 種語言。
可及性 色盲友善主題、高對比調色盤、相容 TalkBack,以及 Box Assist 語音相機模式。

如何取得

  1. 從最新發行頁面下載 APK(例如 Box v3.4.5)。
  2. 對於無 Google 服務的裝置(LineageOS、GrapheneOS、CalyxOS),請使用 custom-rom-support APK。
  3. 可選透過 Obtainium 安裝 – 加入倉儲 URL(https://github.com/jegly/Box)並篩選 APK 名稱(Maincustom-rom-support)。
  4. 應用程式內建內建更新功能;您也可在 設定 → 檢查更新 手動檢查更新。

授權與來源

  • 授權:Apache 2.0(詳見 LICENSE)。
  • 起源:Google AI Edge Gallery 的分支(與 Google 無關)。此專案已新增 50 多項 功能,並停止合併上游變更。
  • 版本標記:上游版本顯示為 1.0.15;Box 自行發行版本以標籤標示(例如 v3.4.5)。

哪些人會使用它?

  • 進階使用者:希望在 Android 手機上擁有完全離線的 AI 助手,特別是配備高階 NPU 的使用者。
  • 可及性倡議者:尋找為視力障礙或低視力使用者設計的語音相機協助功能。
  • 開發者/研究人員:對本地模型部署、硬體加速或在無雲端後端的情況下測試 GGUF 模型感興趣者。
  • 注重隱私的使用者:希望使用 AI 功能卻不希望有任何追蹤資料。

快速總結

Box 將現代 Android 手機轉變為一個自給自足的 AI 工作站:聊天、圖像創作、音訊處理與視覺協助皆在本地執行,支援可選硬體加速,並強調安全性與離線運作。這是一個真實且持續維護的開源專案,專注於行動 AI 領域。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案