Об этом проекте
Apache TVM — это открытый фреймворк компиляции машинного обучения, ориентированный на разработку с приоритетом Python для обеспечения быстрой настройки конвейеров компилятора. Его целью является обеспечение универсального развертывания путем преобразования моделей в минимальные развертываемые модули.
Текущая архитектура использует кросс-уровневый дизайн, включающий TensorIR для представления на уровне тензоров и Relax для представления на уровне графов. Такой дизайн позволяет совместно оптимизировать вычислительные графы, тензорные программы и библиотеки. Кроме того, TVM служит базовой инфраструктурой для создания специализированных вертикальных компиляторов, в том числе для больших языковых моделей (LLMs).