RunanywhereAI/runanywhere-sdks
Production ready toolkit to run AI locally
解決的問題
RunAnywhere 提供統一的 SDK,可在多種裝置(包括手機、瀏覽器、桌面和伺服器)上本地部署 AI 模型。它消除了開發者為不同硬體加速器(如 NPU、GPU 或 CPU)撰寫平台特定程式碼的需要,透過多種程式語言提供單一語意 API。
工作原理
此專案使用單一的 C++ 核心(runanywhere-commons)和純 C ABI,然後透過八種不同的 SDK(Swift、Kotlin、Android、Flutter、React Native、Web、Electron 和 Python)進行封裝。一個能力註冊表會將 AI 任務路由到裝置上可用的最佳引擎。例如,它可以利用 QHexRT 處理 Snapdragon Hexagon NPU,使用 MLX 處理 Apple Silicon,或使用 llama.cpp 實現對 Metal、CUDA 和 WebGPU 的通用相容性。
適用對象
專為需要私有、離線優先 AI 能力(如 LLM、視覺、語音和影像生成)的跨平台應用開發者設計,無需管理硬體特定最佳化之複雜性。
主要亮點
- 多模態支援:包含 LLM 聊天、視覺語言模型(VLM)、語音轉文字(STT)、文字轉語音(TTS)、RAG 和影像生成。
- 廣泛的硬體加速:支援 Snapdragon Hexagon NPU、Apple Neural Engine、Metal、CUDA、WebGPU 和 CPU。
- 統一 API:八種不同 SDK 中提供一致的介面。
- 裝置端隱私:模型設計上完全本地化且離線運行。
- 高階 AI 功能:支援結構化 JSON 輸出、工具呼叫和 LoRA 適配器。
相關
- 專案
- 專案
- Dispatch
- 專案
- 專案