Sobre o projeto

O ONNX Runtime é um acelerador de machine learning multiplataforma projetado tanto para inferência quanto para treinamento. As principais capacidades incluem: - Aceleração de Inferência: Suporta modelos de frameworks de deep learning como PyTorch e TensorFlow/Keras, bem como bibliotecas de ML clássicas como scikit-learn, LightGBM e XGBoost. Ele otimiza o desempenho por meio de transformações de grafo e aceleradores de hardware em vários sistemas operacionais e drivers. - Aceleração de Treinamento: Fornece aceleração para o treinamento de modelos transformer em GPUs NVIDIA de múltiplos nós, integrando-se a scripts de treinamento PyTorch existentes. O projeto é compatível com múltiplas configurações de hardware e fornece um conjunto abrangente de documentação, tutoriais e repositórios de amostras para fluxos de trabalho de inferência e treinamento.