mil-tokyo/webdnn

The Fastest DNN Running Framework on Web Browser

解决的问题

WebDNN 允许开发者在 Web 浏览器中直接运行神经网络推理,无需依赖专用服务器来处理 AI 模型。它特别简化了流程,允许直接将 ONNX 模型加载到浏览器中,无需 Python 预处理。

工作原理

WebDNN 使用浏览器中可用的各种硬件加速技术来转换和执行 ONNX 模型。它支持三种主要后端:

  • WebGPU(使用 WGSL)适用于 Chrome 和 Edge 等现代浏览器。
  • WebGL(支持 WebGL2 并提供 WebGL1 回退)以实现更广泛的兼容性。
  • WebAssembly(通过 emscripten)用于基于 CPU 的执行。

适用人群

希望在 Web 应用中集成 AI 模型推理,而无需依赖外部 API 或服务器端处理的 Web 开发者。

主要亮点

  • 直接支持 ONNX:无需 Python 预processing,可直接将 ONNX 模型加载到浏览器中。
  • 多种加速后端:支持 WebGPU、WebGL 和 WebAssembly,以实现最佳性能。
  • 离线优化:提供在部署前对模型进行离线优化的系统。
  • 动态加载:运算符包可在运行时动态加载,以减少初始加载时间。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目