このプロジェクトについて

Apache TVMは、コンパイラパイプラインの迅速なカスタマイズを可能にするため、Pythonファーストの開発に焦点を当てたオープンな機械学習コンパイルフレームワークです。モデルを最小限のデプロイ可能モジュールに変換することで、ユニバーサルなデプロイメントの提供を目指しています。 現在のアーキテクチャは、テンソルレベル表現のためのTensorIRと、グラフレベル表現のためのRelaxを特徴とするクロスレベル設計を採用しています。この設計により、計算グラフ、テンソルプログラム、およびライブラリの共同最適化が可能になります。さらに、TVMは大規模言語モデル(LLM)向けのものを含む、ドメイン固有の垂直コンパイラを構築するための基盤インフラストラクチャとしても機能します。