jegly/Box

The most advanced, fully offline client-side AI suite on Android today.

What it solves

Box는 보안이 강화된 기능이 풍부한 Android 애플리케이션으로, 다양한 AI 모델을 온디바이스에서 실행하여 프라이버시와 오프라인 기능을 보장합니다. 로컬 AI를 위한 종합 허브 역할을 하며, 텍스트 생성, 이미지 생성, 음성‑텍스트 변환, 텍스트‑음성 변환, 컴퓨터 비전 도구를 네트워크 연결 없이 제공합니다.

How it works

Google AI Edge Gallery를 포크하여 만든 Box는 LiteRT와 llama.cpp를 결합한 하이브리드 엔진을 사용해 다양한 모델을 실행합니다. GGUF 모델 임포트를 지원하고, Google Tensor(TPU), Snapdragon, MediaTek NPU 등 다양한 모바일 칩셋에서 하드웨어 가속을 활용합니다. 앱은 모델 관리와 채팅, 이미지 업스케일링, 음성 인터랙션 등 작업을 위한 전용 인터페이스를 제공합니다.

Who it’s for

프라이버시와 보안을 중시하는 Android 사용자(GrapheneOS, LineageOS와 같은 커스텀 ROM 사용자 포함)와 모바일 기기에서 강력한 멀티모달 AI 모델을 로컬로 실행하고 싶은 AI 애호가를 위한 앱입니다.

Highlights

  • 멀티모달 기능: 텍스트 LLM(Gemma, Qwen, Phi), 이미지 생성, 이미지 업스케일링(초고해상도), 온디바이스 음악/사운드 생성 지원.
  • 하드웨어 가속: Snapdragon, MediaTek, Google Tensor(TPU) 전용 NPU 지원으로 로컬 추론 속도 향상.
  • 프라이버시 & 보안: 바이오메트릭 잠금, SQLCipher를 통한 암호화 채팅 기록, "하드 오프라인" 모드 제공.
  • 보이스 모드: SenseVoice(STT)와 Supertonic(TTS)를 이용한 음성‑to‑음성 AI 채팅 통합.
  • 비전 AI: 온디바이스 이미지 인식, 암호화된 얼굴 인식, 포즈 및 얼굴 메쉬 감지를 위한 시각적 오버레이 제공.
  • 문서 분석: PDF 및 텍스트 파일을 로컬에서 분석 가능.
  • 확장성: llama.cpp와 GGUF 모델 임포트를 지원해 사용자가 직접 모델을 가져올 수 있음.