meta-pytorch/tritonbench

Tritonbench is a collection of PyTorch custom operators with example inputs to measure their performance.

What it solves

TritonBench는 Triton과 PyTorch 통합 성능을 평가하는 표준화된 방법을 제공하여, 연산자가 하드웨어에서 효율적으로 실행되는지 보장합니다.

How it works

벤치마크 스위트로 실행할 수 있는 PyTorch 연산자의 컬렉션입니다. Flash-Attention, FBGEMM, Liger-Kernel을 포함한 다양한 소스의 커널을 통합하여 특정 작업(예: GEMM)의 실행 속도와 성능을 측정합니다.

Who it’s for

GPU 커널 및 연산자의 성능을 벤치마크해야 하는 Triton 및 PyTorch 개발자와 연구자입니다.

Highlights

  • 통합된 서브모듈을 통해 광범위한 연산자를 지원합니다.
  • 독립형 명령줄 도구로 사용하거나 사용자 정의 스크립트를 위한 라이브러리로 설치할 수 있습니다.
  • CUTLASS 및 Flash-Attention과 같은 여러 백엔드 프로젝트와 통합됩니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • Dispatch