mil-tokyo/webdnn

The Fastest DNN Running Framework on Web Browser

解決的問題

WebDNN 允許開發者在 Web 瀏覽器中直接執行神經網路推論,無需依賴專用伺服器來處理 AI 模型。它特別簡化了流程,允許直接將 ONNX 模型載入瀏覽器中,無需 Python 前處理。

工作原理

WebDNN 使用瀏覽器中可用的各種硬體加速技術來轉換和執行 ONNX 模型。它支援三種主要後端:

  • WebGPU(使用 WGSL)適用於 Chrome 和 Edge 等現代瀏覽器。
  • WebGL(支援 WebGL2 並提供 WebGL1 回退)以實現更廣泛的相容性。
  • WebAssembly(透過 emscripten)用於 CPU 執行。

適用對象

希望在 Web 應用中整合 AI 模型推論,而無需依賴外部 API 或伺服器端處理的 Web 開發者。

主要特色

  • 直接支援 ONNX:無需 Python 前處理,可直接將 ONNX 模型載入瀏覽器中。
  • 多種加速後端:支援 WebGPU、WebGL 和 WebAssembly,以實現最佳效能。
  • 離線優化:提供在部署前對模型進行離線優化的系統。
  • 動態載入:運算子套件可在執行時動態載入,以減少初始載入時間。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案