Sobre el proyecto

ONNX Runtime es un acelerador de machine learning multiplataforma diseñado tanto para la inferencia como para el entrenamiento. Las capacidades clave incluyen: - Aceleración de Inferencia: Soporta modelos de frameworks de deep learning como PyTorch y TensorFlow/Keras, así como librerías de ML clásico como scikit-learn, LightGBM y XGBoost. Optimiza el rendimiento mediante transformaciones de grafos y aceleradores de hardware en diversos sistemas operativos y controladores. - Aceleración de Entrenamiento: Proporciona aceleración para el entrenamiento de modelos transformer en GPUs NVIDIA de múltiples nodos, integrándose con scripts de entrenamiento de PyTorch existentes. El proyecto es compatible con múltiples configuraciones de hardware y ofrece un conjunto exhaustivo de documentación, tutoriales y repositorios de ejemplos tanto para flujos de trabajo de inferencia como de entrenamiento.