Speech To Speech é um framework modular para construir agentes de voz com modelos open-source, organizando o pipeline em VAD, STT, LLM e TTS, com suporte a APIs openai, inferência local e baixa latência via WebSocket e WebRTC.
OPEN SOURCE, OPEN TO EVERYONE
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
✳Seleção editorial · Descubra bons projetos open source4109descobertos
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONTopic: speech清除
speech-to-speechhuggingface
NOVOvoxcpmOpenBMB
NOVOVoxCPM2 é um sistema de texto para fala sem tokenização com um modelo autoregressivo de difusão de 2B que suporta 30 idiomas, design de voz a partir de descrições de texto, clonagem de voz controlável e saída de áudio de 48 kHz.
modelscopemodelscope
NOVOO ModelScope é uma biblioteca Python de código aberto que implementa Model-as-a-Service, oferecendo interfaces unificadas pipeline, Trainer e MsDataset para inferência, ajuste fino e avaliação de modelos de CV, NLP, áudio, multimodal e científicos, além de integração com hubs de modelos e datasets.