Mimora est un entraîneur de prononciation gratuit et entièrement local pour l’anglais et l’espagnol. Il utilise la synthèse vocale sur appareil, la reconnaissance vocale et un modèle d’IA local pour générer des phrases et évaluer les tentatives de l’utilisateur avec un retour par mot, sans nécessiter de cloud ni de clés API.
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONNVIDIA NeMo Speech est un framework PyTorch Apache-2.0 pour la création, la personnalisation et le déploiement de modèles d'IA vocale, couvrant la reconnaissance vocale automatique, la synthèse vocale à partir de texte et les grands modèles de langage vocaux, avec des points de contrôle pré-entraînés et des chemins d'installation Docker/uv.
ESPnet est une boîte à outils de traitement de la parole de bout en bout basée sur PyTorch, couvrant la reconnaissance vocale, la synthèse vocale, la traduction, l'amélioration, la diarisation, etc., avec des recettes reproductibles et des modèles pré-entraînés.