ai-dynamo/nixl
NVIDIA Inference Xfer Library (NIXL)
解决的问题
NIXL 解决了 AI 推理框架中节点间高性能点对点通信的需求。它通过提供统一的抽象层,简化了在不同内存类型(CPU 和 GPU)和存储系统(文件、块和对象存储)之间移动数据的过程。
工作原理
NIXL 使用模块化插件架构支持多种后端。它抽象了内存和存储类型,使 AI 框架能够高效传输数据,而无需管理特定硬件或存储介质的底层细节。它可与 UCX 集成用于传输,并使用 ETCD 在分布式环境中实现节点间的元数据分发和协调。
适用对象
该库专为开发 AI 推理框架(如 NVIDIA Dynamo)的开发者,以及需要在 GPU/CPU 内存与各种存储后端之间优化数据传输的分布式 AI 工作负载开发者设计。
主要亮点
- 模块化插件架构:支持 UCX、POSIX、GDS 等多种后端。
- 跨平台内存支持:提供对 CPU 和 GPU 内存以及各种存储类型的抽象。
- 多语言绑定:提供 C++、Python 和 Rust 的 API。
- 分布式协调:可选择性集成 ETCD,用于管理分布式节点间的元数据交换。
- 硬件无关:通过厂商中立的构建选项,支持 NVIDIA GPU(CUDA)和 AMD GPU(ROCm)。
相关
- 项目
- 项目
- 项目
- 项目
- 项目