aws-neuron/aws-neuron-sdk

Powering AWS purpose-built machine learning chips. Blazing fast and cost effective, natively integrated into PyTorch and TensorFlow and integrated with your favorite AWS services

해결하는 문제

AWS의 자체 AI 하드웨어 가속기(Inferentia 및 Trainium)를 위한 딥러닝 및 생성형 AI 워크로드의 개발, 프로파일링, 배포를 고성능 환경에서 제공합니다.

작동 방식

SDK에는 머신러닝 모델을 하드웨어가 실행할 수 있는 형식으로 변환하는 그래프 컴파일러와 런타임이 포함되어 있습니다. PyTorch 및 JAX와 같은 인기 있는 프레임워크와 통합되며, 추론 서빙을 위한 vLLM Neuron도 지원합니다. 고급 사용자를 위해 Neuron Kernel Interface(NKI)를 통해 NeuronCore를 직접 프로그래밍하여 사용자 정의 커널을 개발할 수 있습니다.

대상 사용자

대규모 AI 모델의 학습 또는 추론을 AWS EC2 인스턴스(Inf1, Inf2, Trn1, Trn2, Trn3 등)에서 수행하는 머신러닝 엔지니어 및 개발자입니다.

주요 특징

  • 고성능 딥러닝 및 생성형 AI 지원
  • PyTorch, JAX, vLLM 통합
  • Neuron Kernel Interface(NKI)를 통한 직접 하드웨어 프로그래밍
  • Neuron Explorer을 포함한 전용 개발자 도구

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • Dispatch
  • Dispatch