ROCm/rccl
[DEPRECATED] Moved to ROCm/rocm-systems repo
何を解決するか
RCCL(ROCm Communication Collectives Library)は、GPU向けの標準化された通信ルーチンのセットを提供します。複数のGPU間、特に1つのノード内またはクラスタ内の複数ノードに分散しているGPU間で、効率的にデータを移動・同期する問題を解決します。
動作方法
RCCLは、all-reduce、all-gather、reduce、broadcast、reduce-scatter、gather、scatter、all-to-allといった標準的な集団通信パターンを実装しており、GPU間の直接的な送受信操作もサポートしています。最大のスループットと最小のレイテンシを実現するために、最適化されたリングおよびツリーアルゴリズムを使用しています。このライブラリは、PCIe、xGMI、InfiniBand Verbs、TCP/IPソケットなど、さまざまなハードウェアインターフェースにおいて高帯域幅を最適化しています。
対象ユーザー
AMD GPU上でROCmソフトウェアスタックを使用する、マルチGPUスケーリングと同期を必要とする高性能計算(HPC)およびAIアプリケーションを開発する開発者向けに設計されています。
特徴
- 包括的な集団操作: all-reduce、all-gatherなど、幅広い標準通信ルーチンをサポート。
- 高帯域幅最適化: PCIe、xGMI、InfiniBand、TCP/IPに対応。
- 柔軟な展開: 単一または複数ノードに任意の数のGPUをサポート。
- マルチプロセス対応: 単一プロセスまたはマルチプロセス(例:MPI)アプリケーションと互換性あり。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト