huggingface/optimum

🚀 Accelerate inference and training of 🤗 Transformers, Diffusers, TIMM and Sentence Transformers with easy to use hardware optimization tools

What it solves

Optimum は、特定のハードウェアアクセラレータ上で AI モデルを訓練・実行するプロセスを簡素化し、ユーザーが複雑なハードウェア固有の最適化を手動で行う必要なく、最大効率を実現します。Transformers、Diffusers、TIMM、Sentence‑Transformers などのライブラリ機能を拡張します。

How it works

Optimum は最適化レイヤーとして機能し、モデルのエクスポート、量子化、各種エコシステムでの実行ツールを提供します。以下のハードウェアバックエンド向けに、専用ラッパーと統合を提供します。

  • Inference Engines: ONNX Runtime、OpenVINO、ExecuTorch、NVIDIA TensorRT‑LLM、AWS Inferentia をサポート。
  • Training Wrappers: Intel Gaudi(HPU)や AWS Trainium などのハードウェア向けに、Transformers Trainer の加速訓練ラッパーを提供。
  • Quantization: API またはコマンドラインで Quanto を使用した PyTorch の量子化ツール。

Who it’s for

対象ハードウェア(エッジデバイス、GPU、NPU、専用 AI アクセラレータ)で AI モデルを本番環境にデプロイする必要がある開発者や ML エンジニア、そして訓練パイプラインを高速化したい人向けです。

Highlights

  • Broad Hardware Support: NVIDIA、Intel(OpenVINO、Gaudi)、AMD、AWS(Trainium、Inferentia)、FuriosaAI と統合。
  • Seamless Export: ONNX や ExecuTorch などのフォーマットへのモデルエクスポートが容易。
  • Unified Interface: Python API またはコマンドラインインターフェースを通じて、Hugging Face エコシステムのモデルを一貫した方法で最適化・実行。
  • Accelerated Training: 高性能ハードウェアを用いたモデル訓練とファインチューニングをシンプルに。