apache/tvm
Open Machine Learning Compiler Framework
What it solves
Apache TVMは、オープンソースの機械学習コンパイルフレームワークであり、機械学習コンパイラへのアクセスを容易にすることを目的としています。様々なハードウェア上でモデルを最小限のデプロイ可能モジュールとしてデプロイすることを解決し、つつ、開発者がPython-firstのアプローチを通じてコンパイラパイプラインをカスタマイズできるようにします。
How it works
TVMは、TensorIRによるテンソルレベルの表現と、Relaxによるグラフレベルの表現を特徴とするクロスレベル設計を採用しています。これにより、フレームワークは計算グラフ、テンソルプログラム、およびライブラリを共同で最適化することが可能です。LLMなどの特定ドメインのための垂直コンパイラを構築するための基盤インフラストラクチャとして設計されています。
Who it’s for
異なるハードウェアターゲットに対して機械学習モデルを最適化およびデプロイする必要がある開発者や研究者、およびAI分野のドメイン特定コンパイラを構築している人々を対象としています。
Highlights
- Python-firstの開発により、コンパイラパイプラインの迅速なカスタマイズが可能です。
- 最小限のデプロイ可能モジュールを作成するための、ユニバーサルなデプロイメント能力を備えています。
- クロスレベル表現(TensorIRおよびRelax)による共同最適化。
- LLMなどのドメインのための垂直コンパイラを構築するための基盤として機能します。