Sobre o projeto

O Apache TVM é um framework de compilação de machine learning aberto que foca no desenvolvimento prioritário em Python para permitir a customização rápida de pipelines de compiladores. Seu objetivo é fornecer implantação universal convertendo modelos em módulos implantáveis mínimos. A arquitetura atual utiliza um design de nível cruzado, apresentando o TensorIR para representação em nível de tensor e o Relax para representação em nível de grafo. Esse design permite a otimização conjunta de grafos computacionais, programas de tensor e bibliotecas. Além disso, o TVM serve como infraestrutura fundamental para a construção de compiladores verticais específicos de domínio, incluindo aqueles para Large Language Models (LLMs).