Sobre el proyecto
pyVideoTrans es una herramienta de código abierto para traducir videos de un idioma a otro. Proporciona un flujo de trabajo completo: reconocimiento de voz (ASR), traducción de subtítulos, síntesis de voz (TTS) y síntesis de vídeo. Admite despliegue local fuera de línea y varias APIs en línea.
Las características principales incluyen traducción automática de vídeo, transcripción de audio a subtítulos SRT con diarización de hablantes, doblaje multi-rol con IA y clonación de voz zero-shot mediante F5-TTS, CosyVoice y GPT-SoVITS. Admite modelos ASR como Faster-Whisper, OpenAI Whisper y Alibaba Qwen; traducción LLM a través de DeepSeek, ChatGPT, Claude, Gemini y Ollama; y TTS mediante Edge-TTS, OpenAI, Azure y ChatTTS. La edición interactiva permite la corrección manual en cada etapa.
Las opciones de implementación incluyen un .exe preempaquetado para Windows, despliegue desde el código fuente con uv en macOS/Linux/Windows y despliegue contenedorizado con Docker. Ofrece una GUI, una CLI para procesamiento sin cabeza/lotes y un WebUI para acceso remoto. Incluye herramientas auxiliares para separación de voz, fusión de vídeo/subtítulos y alineación audio-vídeo.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.