huggingface/kernels

Build compute kernels and load them from the Hub.

解决的问题

它为 Python 库和应用程序提供了一种直接从 Hugging Face Hub 动态加载优化计算内核的方法,无需通过 PYTHONPATH 进行传统的 Python 包安装。

工作原理

该项目包含一个名为 kernels 的 Python 包,允许用户从 Hub 下载并执行内核。对于开发者,它还包含一个 kernel-builder 工具,用于创建这些可移植的、带版本控制的内核。这些内核旨在跨不同 Python 版本、PyTorch 构建配置(包括各种 CUDA 版本和 C++ ABIs)以及较旧的 C 库版本之间保持可移植性。

适用人群

  • AI 开发者:需要为应用提供高性能计算内核,但又无需管理复杂安装流程的人。
  • 内核作者:希望构建并分发可在各种环境中兼容的优化计算内核的开发者。

主要亮点

  • 动态加载:直接从 Hugging Face Hub 加载内核。
  • 可移植性:可以从标准 Python 路径之外的路径加载内核。
  • 版本控制:支持在单个 Python 进程中加载同一内核的多个版本。
  • 兼容性:广泛支持最新 Python 版本以及各种 PyTorch/CUDA 配置。

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • 项目
  • Dispatch