프로젝트 소개
pyVideoTrans은 한 어에서 다른 언어로 비디오를 번역하는 오소스 도구입니다. 음성 인식(ASR), 자막 번역, 음성 합성(TTS), 비디오 합성까지 완전한 워크플로우를 제공하며, 로 오프라인 배포와 다양한 온라인 API를 지원합니다.
핵심 기능으로는 완전 자동 비디오 번역, 화자 분리를 포함한 오디오 전사 SRT 자막 생성, 다중 역할 AI 더빙, F5-TTS, CosyVoice, GPT-SoVITS를 통한 제로 음성 클로닝이 있습니다. ASR 모델로 Faster-Whisper, OpenAI Whisper, Alibaba Qwen을 지원하며, LLM 번역은 DeepSeek, ChatGPT, Claude, Gemini, Ollama를 활용하고, TTS는 Edge-TTS, OpenAI, Azure, ChatTTS를 지원합니다. 각 단계에서 수동 교정을 위한 인터랙티브 편집도 가능합니다.
포 옵션으로는 패키징된 Windows .exe, macOS/Linux/Windows에서 uv를 사용한 소스 배포, Docker 컨테이너 배포가 있습니다. GUI, 무인/배치 처리용 CLI, 원격 접속용 WebUI를 제공하며, 보컬 분리, 비디오/자막 병합, 오디오-비디오 정렬 등 유틸리티 도구도 포함되어 있습니다.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.