mil-tokyo/webdnn
The Fastest DNN Running Framework on Web Browser
해결하는 문제
WebDNN은 개발자가 웹 브라우저 내에서 직접 신경망 추론을 수행할 수 있게 해주며, AI 모델을 처리하기 위한 전용 서버가 필요 없도록 합니다. 특히 ONNX 모델을 Python 전처리 없이 브라우저에 직접 로드할 수 있도록 하여 프로세스를 간소화합니다.
작동 방식
WebDNN은 브라우저에서 사용 가능한 다양한 하드웨어 가속 기술을 사용하여 ONNX 모델을 변환하고 실행합니다. 주요 세 가지 백엔드를 지원합니다:
- WebGPU (WGSL 사용): Chrome 및 Edge와 같은 최신 브라우저용.
- WebGL (WebGL2 및 WebGL1 백업 포함): 더 넓은 호환성 제공.
- WebAssembly (emscripten 경유): CPU 기반 실행용.
대상 사용자
외부 API나 서버 측 처리에 의존하지 않고 웹 애플리케이션에 AI 모델 추론을 통합하고자 하는 웹 개발자.
주요 특징
- 직접적인 ONNX 지원: Python 전처리 없이 브라우저에 ONNX 모델을 직접 로드 가능.
- 다중 가속 백엔드: 최적의 성능을 위해 WebGPU, WebGL, WebAssembly 지원.
- 오프라인 최적화: 배포 전에 모델을 오프라인으로 최적화할 수 있는 시스템 제공.
- 동적 로딩: 런타임에 연산자 번들(dynamic loading)을 동적으로 로드하여 초기 로드 시간을 단축.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트