nndeploy/nndeploy
一款简单易用和高性能的AI部署框架 | An Easy-to-Use and High-Performance AI Deployment Framework
解決する課題
nndeployは、エッジデバイスおよびローカルハードウェア上のAIアルゴリズムのデプロイを簡素化・高速化することを目的としています。Windows、macOS、Android、iOS、NVIDIA Jetson、Ascend、RKなど多様なプラットフォームへのモデル移植の課題と、リアルタイム推論に最適化されたパフォーマンスの実現を解決します。
動作方法
このフレームワークは、ユーザーがノードをドラッグアンドドロップしてAIパイプラインを構築できる視覚的なワークフローエディタを使用しています。これらのワークフローはJSONファイルとしてエクスポートされ、C++またはPython APIを介して読み込まれて実行できます。高性能を確保するために、TensorRT、ONNXRuntime、OpenVINOなど13種類の異なる推論エンジンを統合し、パイプライン並列処理、ゼロコピーメモリ管理、メモリプールなどの最適化戦略を実装しています。
対象ユーザー
複数のプラットフォーム間でモデルをデプロイし、各ハードウェアターゲットごとにコードを再記述せずにクロスプラットフォーム互換性を維持したいAI開発者やエンジニア向けです。
主な特徴
- 視覚的ワークフロー:リアルタイムでのパラメータ調整が可能なドラッグアンドドロップインターフェースで、AIパイプラインの構築とデバッグが可能。
- マルチプラットフォーム対応:デスクトップ、モバイル、エッジコンピューティングデバイス間で一貫したデプロイが可能。
- 拡張性:PythonまたはC++/CUDAで書かれたカスタムノードをサポートし、特殊な前処理や高性能なロジックを実装可能。
- 広範なエンジン統合:13の主流推論フレームワークと深く統合されており、特定のハードウェアに最適なエンジンを選択できる。
- 即時利用可能なモデル:LLM(QWen)、画像生成(Stable Diffusion)、OCR、オブジェクト検出(YOLOシリーズ)用の事前デプロイ済みノードを提供。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト