Voicebox est un studio vocal IA open source et local, gratuit, couvrant TTS, clonage vocal, dictée, effets audio et sortie vocale d'agents via MCP.
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONPremove ITN est une bibliothèque open-source de normalisation inverse de texte sensible au contexte pour les transcriptions d'agents vocaux en anglais. Elle convertit la sortie ASR en formes écrites canoniques via un pipeline générer-scorer-décoder avec DeBERTa.
RunAnywhere est une suite d’SDK multi-plateforme permettant d’exécuter des modèles d’IA entièrement sur appareil — téléphones, navigateurs, ordinateurs de bureau et serveurs. Elle prend en charge les LLM, la vision, la parole, les agents vocaux, le RAG, les embeddings et la génération d’images via une API sémantique unique.
SenseVoiceSmall est un modèle de fondation vocal open source pour la reconnaissance vocale, l'identification de langue, la reconnaissance d'émotions et la détection d'événements audio, couvrant le mandarin, le cantonais, l'anglais, le japonais et le coréen avec une inférence non autorégressive rapide.
Centre d'appel open source natif IA : l'IA vocale répond en premier via OpenAI Realtime ou Qwen, puis transfère vers des agents humains sur les files FreeSWITCH avec un softphone navigateur. Un unique binaire Go avec API REST, SSE, interface React embarquée et PostgreSQL.