RunanywhereAI/runanywhere-sdks

Production ready toolkit to run AI locally

解决的问题

RunAnywhere 提供统一的 SDK,可在多种设备(包括手机、浏览器、桌面和服务器)上本地部署 AI 模型。它消除了开发者为不同硬件加速器(如 NPU、GPU 或 CPU)编写平台特定代码的需要,通过多种编程语言提供单一语义 API。

工作原理

该项目使用单一的 C++ 核心(runanywhere-commons)和纯 C ABI,然后通过八种不同的 SDK(Swift、Kotlin、Android、Flutter、React Native、Web、Electron 和 Python)进行封装。一个能力注册表会将 AI 任务路由到设备上可用的最佳引擎。例如,它可以利用 QHexRT 处理 Snapdragon Hexagon NPU,使用 MLX 处理 Apple Silicon,或使用 llama.cpp 实现对 Metal、CUDA 和 WebGPU 的通用兼容性。

适用人群

专为需要私有、离线优先 AI 能力(如 LLM、视觉、语音和图像生成)的跨平台应用开发者设计,无需管理硬件特定优化的复杂性。

主要亮点

  • 多模态支持:包含 LLM 聊天、视觉语言模型(VLM)、语音转文本(STT)、文本转语音(TTS)、RAG 和图像生成。
  • 广泛的硬件加速:支持 Snapdragon Hexagon NPU、Apple Neural Engine、Metal、CUDA、WebGPU 和 CPU。
  • 统一 API:八个不同 SDK 中提供一致的接口。
  • 设备端隐私:模型设计上完全本地化且离线运行。
  • 高级 AI 功能:支持结构化 JSON 输出、工具调用和 LoRA 适配器。

相关

  • 项目
  • 项目
  • Dispatch
  • 项目
  • 项目