À propos du projet
audio.cpp est un moteur d'inférence tout-en-un, entièrement en C++, pour les modèles audio, propulsé par ggml. Il élimine le besoin d'environnements Python complexes, fournissant un runtime natif partagé pour diverses tâches audio. Les principales fonctionnalités incluent :
- **Prise en charge étendue des modèles** : Prend en charge plus de 80 familles de modèles et plus de 120 variantes pour la synthèse vocale (TTS), la reconnaissance automatique de la parole (ASR), la détection d'activité vocale (VAD), le clonage vocal, la conversion vocale, la génération musicale, la séparation de sources et la diarisation des locuteurs.
- **Haute performance** : Optimisé pour CUDA, Metal, ROCm, Vulkan et CPU. Il atteint des accélérations significatives (jusqu'à 8 fois plus rapide que les chemins Python) et une latence réduite.
- **Format GGUF** : Prend entièrement en charge le format de modèle GGUF, avec des packages Q8 optimisés et d'autres quantifiés pour une utilisation efficace de la mémoire et de la vitesse.
- **Portabilité** : Fonctionne sur Windows, Linux et macOS, prenant en charge les GPU NVIDIA, AMD et Apple Silicon.
- **Prêt pour la production** : Dispose de sessions réutilisables, d'inférence hors ligne par lots, de prise en charge du streaming, d'utilitaires audio intégrés (débruitage, rééchantillonnage, STFT) et de prise en charge de pipelines JSON pour des flux de travail en plusieurs étapes.
- **Interfaces utilisateur** : Inclut une interface en ligne de commande (CLI), un serveur API et une WebUI native avec un onglet Arena pour la comparaison de modèles côte à côte.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.