RunanywhereAI/runanywhere-sdks
Production ready toolkit to run AI locally
해결하는 문제
RunAnywhere는 스마트폰, 브라우저, 데스크톱, 서버 등 다양한 장치에 AI 모델을 로컬로 배포할 수 있는 통합 SDK를 제공합니다. NPUs, GPU, CPU와 같은 다양한 하드웨어 가속기용으로 플랫폼별 코드를 작성할 필요 없이, 여러 프로그래밍 언어에서 일관된 세미틱 API를 제공합니다.
작동 방식
이 프로젝트는 단일 C++ 커널(runanywhere-commons)과 순수 C ABI를 사용하며, 이는 Swift, Kotlin, Android, Flutter, React Native, Web, Electron, Python의 8가지 다른 SDK로 래핑됩니다. 기능 레지스트리가 장치에서 사용 가능한 최적의 엔진으로 AI 작업을 라우팅합니다. 예를 들어 Snapdragon Hexagon NPU에는 QHexRT를, Apple Silicon에는 MLX를, Metal, CUDA, WebGPU와 호환되는 일반적인 경우에는 llama.cpp를 사용할 수 있습니다.
대상 사용자
개인정보 보호와 오프라인 우선의 AI 기능(예: LLM, 비전, 음성, 이미지 생성)이 필요한 크로스플랫폼 애플리케이션을 개발하는 개발자들을 위한 것입니다. 하드웨어별 최적화의 복잡성을 관리하고 싶지 않은 사용자에게 적합합니다.
주요 특징
- 다중 모달 지원: LLM 채팅, 비전 언어 모델(VLM), 음성-텍스트(STT), 텍스트-음성(TTS), RAG, 이미지 생성을 포함합니다.
- 광범위한 하드웨어 가속: Snapdragon Hexagon NPU, Apple Neural Engine, Metal, CUDA, WebGPU, CPU를 지원합니다.
- 통합 API: 8개의 다른 SDK에서 일관된 인터페이스를 제공합니다.
- 장치 내 개인정보 보호: 모델은 설계상 완전히 로컬 및 오프라인에서 실행됩니다.
- 고급 AI 기능: 구조화된 JSON 출력, 도구 호출, LoRA 어댑터를 지원합니다.
관련
- 프로젝트
- 프로젝트
- Dispatch
- 프로젝트
- 프로젝트