Intellindust-AI-Lab/EdgeCrafter

[TMLR 26] EdgeCrafter: Compact ViTs for Edge Dense Prediction via Task-Specialized Distillation

何を解決するか

EdgeCrafterは、エッジデバイスに高性能なVision Transformer (ViT)を展開する課題に対処します。高精度な密予測タスク(オブジェクト検出、インスタンスセグメンテーション、ポーズ推定など)を維持しつつ、リアルタイムのエッジデプロイに適した小型かつ高速なモデルを提供します。

仕組み

本プロジェクトは、タスク特化型の蒸留技術を用いて、一連のコンパクトなViTを構築します。Small、Medium、Large、Extra-Largeのさまざまなモデルサイズを提供し、性能と遅延のトレードオフに応じて選択可能です。これらのモデルは、NVIDIA GPU(TensorRT経由)、Intel iGPU/dGPU(torch.xpu経由)、CPUなど、さまざまなハードウェアバックエンドで効率的に動作するように設計されています。

対象ユーザー

エッジハードウェア向けのコンピュータビジョンアプリケーションを開発するAI研究者や開発者で、高精度(AP)と低遅延のバランスを求める方々に最適です。

特徴

  • マルチタスク対応:オブジェクト検出(ECDet)、インスタンスセグメンテーション(ECSeg)、ポーズ推定(ECPose)向けの専用モデル。
  • ハードウェアの柔軟性:CUDA、Intel XPU(iGPU/dGPU)、CPUをネイティブでサポート。
  • エッジ最適化:低遅延設計。最小モデルではNVIDIA T4で推論速度がわずか5.41msまで達成可能。
  • 広範な統合:Intel® Geti™、LightlyTrain、LibreYOLOなど、さまざまなツールに統合済み。

関連

  • プロジェクト
  • Dispatch
  • プロジェクト
  • プロジェクト
  • プロジェクト