À propos du projet
pyVideoTrans est un outil open-source pour traduire des vidéos d'une langue à une autre. Il propose un flux de travail complet : reconnaissance vocale (ASR), traduction des sous-titres, synthèse vocale (TTS) et synthèse vidéo. Il prend en charge le déploiement local hors ligne ainsi que diverses APIs en ligne.
Les fonctionnalités clés incluent la traduction vidéo entièrement automatique, la transcription audio en sous-titres SRT avec diarisation des intervenants, le doublage multi-rôles par IA, et le clonage vocal zero-shot via F5-TTS, CosyVoice et GPT-SoVITS. Il prend en charge les modèles ASR tels que Faster-Whisper, OpenAI Whisper et Alibaba Qwen ; la traduction par LLM via DeepSeek, ChatGPT, Claude, Gemini et Ollama ; et le TTS via Edge-TTS, OpenAI, Azure et ChatTTS. Une édition interactive permet une relecture manuelle à chaque étape.
Les options de déploiement comprennent un .exe Windows pré-emballé, un déploiement source avec uv sur macOS/Linux/Windows, et un déploiement conteneurisé Docker. Il offre une interface graphique, une CLI pour le traitement sans tête/en lots, et un WebUI pour l'accès à distance. Des utilitaires pour la séparation vocale, la fusion vidéo/sous-titres et l'alignement audio-vidéo sont également inclus.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.