OPEN SOURCE, OPEN TO EVERYONE

Code ouvert. Horizons nouveaux.

Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.

Sélection humaine · Découvrez de bons projets open source4109découverts

Un peu de curiosité. Un monde de code ouvert.

THE FIRST COLLECTION
Topic: speech-synthesis清除
voxcpmOpenBMB
NOUVEAU

VoxCPM2 est un système de synthèse vocale texte-parole sans tokeniseur doté d'un modèle autoregressif de diffusion de 2B prenant en charge 30 langues, la conception de voix à partir de descriptions textuelles, le clonage de voix contrôlable et une sortie audio de 48 kHz.

IAMusiqueMultimodal AI
speechNVIDIA-NeMo
NOUVEAU

NVIDIA NeMo Speech est un framework PyTorch Apache-2.0 pour la création, la personnalisation et le déploiement de modèles d'IA vocale, couvrant la reconnaissance vocale automatique, la synthèse vocale à partir de texte et les grands modèles de langage vocaux, avec des points de contrôle pré-entraînés et des chemins d'installation Docker/uv.

IAMusiqueModel runtime
espnetespnet
NOUVEAU

ESPnet est une boîte à outils de traitement de la parole de bout en bout basée sur PyTorch, couvrant la reconnaissance vocale, la synthèse vocale, la traduction, l'amélioration, la diarisation, etc., avec des recettes reproductibles et des modèles pré-entraînés.

IADéveloppementModel runtime
funttsfarfarfun
NOUVEAU

FunTTS est une bibliothèque de synthèse vocale (TTS) à interface unifiée, permettant une commutation fluide entre divers moteurs open-source, avec des fonctions de génération de sous-titres, de dialogues multi-rôles et de traitement asynchrone.

DéveloppementMusiqueTemplates & starters
speech-to-speechhuggingface
NOUVEAU

Un pipeline d'agent vocal modulaire à faible latence (VAD -> STT -> LLM -> TTS) implémentant l'ensemble d'événements OpenAI Realtime sur WebSocket et WebRTC.

IADéveloppementAI assistants