xybrid-ai/xybrid
Cross-platform on-device AI toolkit
Xybrid – 앱 및 게임용 디바이스 내 AI
무엇인가요 – Xybrid은 대규모 언어 모델(LLM), 음성 인식(ASR), 음성 합성(TTS)을 다양한 플랫폼에서 디바이스 내부에서 로컬로 실행할 수 있는 오픈소스 SDK입니다. Flutter, Swift, Kotlin, Unity, Rust, Python, 웹에서 동작하는 일관된 API를 제공하며, ONNX, GGUF, SafeTensors 형식의 모델을 로드할 수 있습니다.
왜 중요한가요 – 추론은 모두 디바이스에서 이루어지므로, 초기 모델 다운로드 이후 클라우드 서비스나 API 키가 필요하지 않습니다. 이로 인해 프라이버시 보장, 오프라인 작동, 앱 재배포 없이 런타임에 모델 교체가 가능해집니다.
핵심 기능
| 기능 | 세부 사항 |
|---|---|
| 음성 인식 | Whisper‑tiny, Wav2Vec2‑base 및 기타 ONNX/ggml 모델. |
| 음성 합성 | Kokoro‑82M, KittenTTS‑Nano, NeuTTS‑Nano – 출력은 24 kHz WAV 파일. |
| LLM 추론 | 수백 개의 모델(LFM2.5, SmolLM2, Gemma, Llama 3.2, Qwen 3.5, Bonsai 27B 등)을 지원하며, 도구 호출 및 사고 체인(chain-of-thought) 기능 포함. |
| 시각 언어 모델 | 컴팩트한 VLM(LFM2‑VL, LFM2.5‑VL). |
| 다중 모델 파이프라인(MMP) | 작은 YAML 설명으로 ASR → LLM → TTS(또는 임의의 순서)를 연결 가능. |
| 하드웨어 가속 | iOS/macOS에서는 Metal + Apple Neural Engine, Linux에서는 선택적 Vulkan, 기타 플랫폼은 CPU. |
| 하이브리드/클라우드 백업 | 디바이스가 처리할 수 없을 경우 원격 서비스로 전달 가능. |
| 텔레메트리(선택적) | API 키를 통해 사용 통계를 전송할 수 있음. |
지원 플랫폼 및 언어 바인딩
| 플랫폼 | 바인딩 | 패키지 매니저 |
|---|---|---|
| Flutter | xybrid_flutter |
pub.dev |
| iOS / macOS (Swift) | xybrid (Swift Package) |
Swift Package Manager |
| Android (Kotlin) | xybrid-kotlin |
Maven Central |
| Unity | ai.xybrid.sdk |
OpenUPM / Git URL |
| Rust | xybrid crate |
crates.io |
| Python | xybrid 바인딩(소스) |
pip(소스 경유) |
| Web(프리뷰) | JavaScript SDK | npm(프리뷰) |
| CLI | xybrid 실행 파일 |
스크립트 설치기 |
시작하기 (Flutter 예제)
# pubspec.yaml
dependencies:
xybrid_flutter: ^0.6.0
final model = await Xybrid.model('kokoro-82m').load();
final result = await model.run(XybridEnvelope.text('Hello world'));
// result는 24 kHz WAV 오디오 버퍼
이 패턴은 Kotlin, Swift, C#(Unity), Rust에서도 동일하게 작동합니다. 모델 ID로 모델을 로드하고, Envelope(텍스트 또는 오디오)를 입력하면 처리된 오디오를 받을 수 있습니다.
모델 카탈로그
Xybrid은 내장된 레지스트리(xybrid.ai/models 참조)를 제공하며, 다음 모델을 포함합니다:
- ASR – Whisper‑tiny(39 M), Wav2Vec2‑base(95 M)
- TTS – Kokoro‑82M(82 M, 24보이스), KittenTTS‑Nano(15 M), NeuTTS‑Nano(120 M)
- LLMs – 230 M에서 27 B 파라미터까지, 다국어, 추론, 도구 호출, 멀티모달 모델 포함.
- 시각 언어 – 컴팩트한 VLM(450 M–3 B).
자신의 모델도
model_metadata.json을 제공하여 추가 가능(실험적).
유사 프로젝트와의 차이점
| 기능 | Xybrid | Ollama | llama.cpp | ONNX Runtime |
|---|---|---|---|---|
| 모바일(iOS/Android) | ✅ | ❌ | ❌ | ✅ |
| Unity 통합 | ✅ | ❌ | ❌ | ❌ |
| 다중 모델 파이프라인 | ✅ | ❌ | ❌ | ❌ |
| 하나의 SDK로 ASR + LLM + TTS 통합 | ✅ | ❌ | ❌ | ❌ |
| 인프로세스 실행, 서버 없음 | ✅ | ❌ | ✅ | ✅ |
| 오프라인 우선, 클라우드 필요 없음 | ✅ | ✅ | ✅ | ✅ |
라이선스 및 커뮤니티
- 라이선스 – Apache 2.0(허용성 높음, 상용 사용에 적합).
- 문서 – https://docs.xybrid.dev
- Discord – https://discord.gg/YhFHHkhbad
- GitHub – 이슈, 풀 리퀘스트, 좋은 첫 이슈, CONTRIBUTING 가이드 제공.
TL;DR
Xybrid은 모바일 앱, 데스크톱 소프트웨어, Unity 게임에 음성 인식, 음성 합성, 대규모 언어 모델 추론을 통합할 수 있는 통합적이고 오프라인 우선의 방법을 개발자에게 제공합니다. 주요 언어용 준비된 바인딩과 하드웨어 가속 실행 환경을 갖추고 있습니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- Dispatch
- 프로젝트