huggingface/optimum-intel

🤗 Optimum Intel: Accelerate inference with Intel optimization tools

What it solves

它简化了在 Intel 硬件上加速 AI 模型的流程。它作为热门 AI 库(如 Transformers, Diffusers, 和 Sentence Transformers)与 OpenVINO 工具包之间的桥梁,允许用户在 Intel CPU、GPU 和专用 AI 加速器上更高效地优化与运行模型。

How it works

该项目提供了一套工具,将 AI 模型转换为 OpenVINO Intermediate Representation (IR) 格式。用户可以使用命令行工具 (optimum-cli) 或基于 Web 的 Space 来导出模型。一旦转换完成,该库提供特定的类(如 OVModelForCausalLM)来加载这些优化后的模型,以进行高性能推理。

Who it’s for

想要在 Intel 架构系统上部署时最大化模型性能的开发者与机器学习工程师。

Highlights

  • 在 Intel CPU、GPU 和 DL 加速器上的高性能推理。
  • 通过 CLI 或 Hub space 简单地将模型导出为 OpenVINO IR 格式。
  • 支持后训练静态量化(例如 int8)以进一步减小模型大小并提高速度。
  • 与 🤗 Transformers, Diffusers, 和 timm 库的集成。