triton-lang/triton

Development repository for the Triton language and compiler

해결하는 문제

Triton은 매우 효율적인 커스텀 딥러닝 프리미티브를 작성하는 어려움을 해결합니다. CUDA보다 높은 생산성과 기존의 다른 도메인 특화 언어(DSL)보다 더 큰 유연성을 제공하여 고성능 GPU 코드를 작성할 수 있는 방법을 목표로 합니다.

작동 방식

Triton은 개발자가 타일 기반의 신경망 계산을 정의할 수 있는 언어 및 컴파일러입니다. LLVM을 사용하여 NVIDIA 및 AMD GPU, CPU용 최적화된 코드를 생성하며, 중간 표현(IR)을 사용하고 MLIR을 활용해 성능과 유연성을 향상시킨 백엔드를 재작성했습니다.

대상 사용자

저수준 CUDA 코드를 작성하지 않고도 고성능 커스텀 딥러닝 커널과 프리미티브를 생성해야 하는 개발자 및 연구자들을 위한 것입니다.

주요 특징

  • 다중 하드웨어 지원: NVIDIA GPU(Compute Capability 8.0 이상), AMD GPU(ROCm 6.2 이상), CPU(개발 중).
  • 높은 생산성: CUDA보다 효율적인 코드 작성 환경을 제공합니다.
  • 컴파일러 기반: 코드 생성 및 최적화의 복잡성을 LLVM과 MLIR가 처리합니다.
  • 인터프리터 모드: GPU 없이도 커널을 실행하고 디버깅할 수 있는 Triton 인터프리터를 포함합니다.

관련

  • 프로젝트
  • 프로젝트
  • Dispatch
  • 프로젝트
  • 프로젝트