triton-lang/triton

Development repository for the Triton language and compiler

何を解決するか

Tritonは、高度に効率的なカスタムディープラーニングプリミティブを書くことの難しさに対処します。CUDAよりも高い生産性を提供し、他の既存のドメイン固有言語(DSL)よりも柔軟性がある高速GPUコードの記述方法を提供することを目指しています。

動作方法

Tritonは、開発者がタイル化されたニューラルネットワーク計算を定義できる言語およびコンパイラです。LLVMを用いてGPU(NVIDIAおよびAMD)およびCPU向けに最適化されたコードを生成し、中間表現(IR)を使用し、MLIRを活用してパフォーマンスと柔軟性を向上させたバックエンドを再実装しています。

対象ユーザー

低レベルのCUDAコードを書かずに、高性能なカスタムディープラーニングカーネルやプリミティブを作成したい開発者や研究者向けに設計されています。

主な特徴

  • マルチハードウェア対応: NVIDIA GPU(Compute Capability 8.0+)、AMD GPU(ROCm 6.2+)、CPU(開発中)に対応。
  • 高い生産性: CUDAと比較して、効率的なコードを記述しやすい環境を提供。
  • コンパイラ駆動: コード生成および最適化の複雑さをLLVMとMLIRが処理。
  • インタプリタモード: GPUがなくてもカーネルを実行・デバッグできるTritonインタプリタを搭載。

関連

  • プロジェクト
  • プロジェクト
  • Dispatch
  • プロジェクト
  • プロジェクト