huggingface/optimum-intel

🤗 Optimum Intel: Accelerate inference with Intel optimization tools

What it solves

Intel ハードウェア上での AI モデルの加速プロセスを簡素化します。人気の AI ライブラリ(Transformers, Diffusers, および Sentence Transformers)と OpenVINO ツールキットの間の橋渡し役を務め、ユーザーが Intel CPU、GPU、および専用の AI アクセラレータ上でモデルをより効率的に最適化および実行できるようにします。

How it works

このプロジェクトは、AI モデルを OpenVINO Intermediate Representation (IR) 形式に変換するためのツールセットを提供します。ユーザーはコマンドラインツール (optimum-cli) または Web ベースの Space を使用してモデルをエクスポートできます。変換後、このライブラリは特定のクラス(例: OVModelForCausalLM)を提供し、これらの最適化されたモデルを高性能推論のためにロードします。

Who it’s for

Intel ベースのシステムにデプロイする場合に、モデルのパフォーマンスを最大化したい開発者や機械学習エンジニアです。

Highlights

  • Intel CPU、GPU、および DL アクセラレータ上での高性能推論。
  • CLI または Hub space を介した OpenVINO IR 形式への簡単なモデルエクスポート。
  • ポストトレーニング静的量子化(例: int8)をサポートし、モデルのサイズをさらに縮小し、速度を向上させます。
  • 🤗 Transformers, Diffusers, および timm ライブラリとの統合。