Sobre el proyecto
Apache TVM es un marco de compilación de aprendizaje automático abierto que se centra en el desarrollo prioritario en Python para permitir una personalización rápida de las canalizaciones del compilador. Su objetivo es proporcionar un despliegue universal convirtiendo los modelos en módulos desplegables mínimos.
La arquitectura actual utiliza un diseño de nivel cruzado que presenta TensorIR para la representación a nivel de tensor y Relax para la representación a nivel de grafo. Este diseño permite la optimización conjunta de grafos computacionales, programas de tensores y bibliotecas. Además, TVM sirve como infraestructura fundamental para la construcción de compiladores verticales específicos de dominio, incluidos aquellos para Modelos de Lenguaje Extensos (LLMs).