ROCm/legacy-rocm-build

AMD ROCm™ Software - GitHub Home

解决的问题

ROCm 提供一个开源软件栈,使开发者能够为高性能计算(HPC)、人工智能(AI)、科学计算和计算机辅助设计(CAD)编程 AMD GPU。它弥合了低级别 GPU 内核与最终用户应用程序之间的差距,使复杂工作负载能够实现 GPU 加速。

工作原理

ROCm 由 HIP 驱动,HIP 是一种 C++ 运行时 API 和内核语言,允许开发者使用类似于 NVIDIA CUDA 的接口编写可移植的 GPU 代码。该栈包含全面的驱动程序、开发工具和 API,包括:

  • 数学与计算库:专用于线性代数、FFT 和随机数生成的库(例如 rocBLAS、rocFFT)。
  • 运行时与编译器:如 LLVM 和 ROCr 运行时,用于构建和运行 GPU 工作负载。
  • 集成:与 PyTorch 和 TensorFlow 等主要机器学习框架直接兼容。
  • 工具:专用的性能分析、调试和监控工具(例如 ROCgdb、AMD SMI)。

适用人群

专为使用 AMD GPU 硬件进行 AI 训练与推理、科学计算和高性能计算的开发者和研究人员设计。

主要亮点

  • 类 CUDA 接口:使用 HIP 实现可移植的 GPU 编程。
  • 丰富的库生态系统:包含大量数学、通信和媒体库。
  • 主流框架支持:与 PyTorch、TensorFlow 和 JAX 集成。
  • 广泛的硬件支持:兼容多种 Linux 发行版中的 CDNA 和 RDNA 架构。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目