RunanywhereAI/runanywhere-sdks

Production ready toolkit to run AI locally

解決的問題

RunAnywhere 提供統一的 SDK,可在多種裝置(包括手機、瀏覽器、桌面和伺服器)上本地部署 AI 模型。它消除了開發者為不同硬體加速器(如 NPU、GPU 或 CPU)撰寫平台特定程式碼的需要,透過多種程式語言提供單一語意 API。

工作原理

此專案使用單一的 C++ 核心(runanywhere-commons)和純 C ABI,然後透過八種不同的 SDK(Swift、Kotlin、Android、Flutter、React Native、Web、Electron 和 Python)進行封裝。一個能力註冊表會將 AI 任務路由到裝置上可用的最佳引擎。例如,它可以利用 QHexRT 處理 Snapdragon Hexagon NPU,使用 MLX 處理 Apple Silicon,或使用 llama.cpp 實現對 Metal、CUDA 和 WebGPU 的通用相容性。

適用對象

專為需要私有、離線優先 AI 能力(如 LLM、視覺、語音和影像生成)的跨平台應用開發者設計,無需管理硬體特定最佳化之複雜性。

主要亮點

  • 多模態支援:包含 LLM 聊天、視覺語言模型(VLM)、語音轉文字(STT)、文字轉語音(TTS)、RAG 和影像生成。
  • 廣泛的硬體加速:支援 Snapdragon Hexagon NPU、Apple Neural Engine、Metal、CUDA、WebGPU 和 CPU。
  • 統一 API:八種不同 SDK 中提供一致的介面。
  • 裝置端隱私:模型設計上完全本地化且離線運行。
  • 高階 AI 功能:支援結構化 JSON 輸出、工具呼叫和 LoRA 適配器。

相關

  • 專案
  • 專案
  • Dispatch
  • 專案
  • 專案