speechNVIDIA-NeMo
NOUVEAUNVIDIA NeMo Speech est un framework PyTorch Apache-2.0 pour la création, la personnalisation et le déploiement de modèles d'IA vocale, couvrant la reconnaissance vocale automatique, la synthèse vocale à partir de texte et les grands modèles de langage vocaux, avec des points de contrôle pré-entraînés et des chemins d'installation Docker/uv.