speech-to-speechhuggingface
NOVOSpeech To Speech é um framework modular para construir agentes de voz com modelos open-source, organizando o pipeline em VAD, STT, LLM e TTS, com suporte a APIs openai, inferência local e baixa latência via WebSocket e WebRTC.