À propos du projet

Apache TVM est un framework de compilation d'apprentissage automatique ouvert qui privilégie le développement en Python pour permettre une personnalisation rapide des pipelines de compilation. Il vise à assurer un déploiement universel en convertissant les modèles en modules déployables minimaux. L'architecture actuelle utilise une conception multi-niveaux comprenant TensorIR pour la représentation au niveau tenseur et Relax pour la représentation au niveau graphique. Cette conception permet l'optimisation conjointe des graphes de calcul, des programmes tenseurs et des bibliothèques. De plus, TVM sert d'infrastructure fondamentale pour la construction de compilateurs verticaux spécifiques à un domaine, y compris ceux destinés aux Large Language Models (LLMs).