triton-lang/triton
Development repository for the Triton language and compiler
解決的問題
Triton 解決了撰寫高度高效自訂深度學習原語的困難。其目標是提供一種比 CUDA 更高生產力、比其他現有領域特定語言(DSL)更具彈性的方法,來撰寫高性能 GPU 程式碼。
工作原理
Triton 是一種語言與編譯器,允許開發者定義分塊的神經網路運算。它使用 LLVM 為 GPU(NVIDIA 與 AMD)與 CPU 產生最佳化程式碼,採用中間表示(IR),並重寫後端以使用 MLIR,以提升效能與彈性。
適用對象
專為需要建立高效率自訂深度學習核心與原語,但又不需撰寫低階 CUDA 程式碼的開發者與研究人員設計。
主要亮點
- 多硬體支援:相容 NVIDIA GPU(計算能力 8.0+)、AMD GPU(ROCm 6.2+)與 CPU(開發中)。
- 高生產力:相比 CUDA,提供更易用的高效程式碼撰寫環境。
- 編譯器驅動:利用 LLVM 與 MLIR 處理程式碼產生與最佳化的複雜性。
- 解釋器模式:內建 Triton 解釋器,可在無 GPU 情況下執行與除錯核心。
相關
- 專案
- 專案
- Dispatch
- 專案
- 專案