عن المشروع

pyVideoTrans هي أداة مفتوحة المصدر لترجمة الفيديوهات من لغة إلى أخرى. تقدم سير عمل متكاملاً يشمل: التعرف التلقائي على الكلام (ASR)، ترجمة الترجمات النصية، توليف الكلام (TTS)، وتوليف الفيديو. تدعم النشر المحلي غير المتصل بالإنترنت ومجموعة متنوعة من واجهات برمجة التطبيقات عبر الإنترنت. من أبرز الميزات: الترجمة التلقائية الكاملة للفيديو، تحويل الصوت إلى ترجمات نصية بتنسيق SRT مع تحديد المتحدثين، الدبلجة بالذكاء الاصطناعي بأدوار متعددة، واستنساخ الأصوات بدون تدريب مسبق عبر F5-TTS وCosyVoice وGPT-SoVITS. تدعم نماذج ASR مثل Faster-Whisper وOpenAI Whisper وAlibaba Qwen. كما تدعم الترجمة عبر نماذج اللغات الكبيرة مثل DeepSeek وChatGPT وClaude وGemini وOllama، وتوليف الكلام عبر Edge-TTS وOpenAI وAzure وChatTTS. تتيح أدوات التحرير التفاعلية المراجعة اليدوية في كل مرحلة. تشمل خيارات النشر: ملف Windows .exe جاهز، النشر من المصدر باستخدام uv على macOS/Linux/Windows، والنشر عبر حاوية Docker. توفر الأداة واجهة رسومية (GUI) وواجهة سطر أوامر (CLI) للمعالجة بدون واجهة أو الدفعات، بالإضافة إلى واجهة ويب (WebUI) للوصول عن بُعد. تتضمن أيضاً أدوات مساعدة لفصل الصوتيات ودمج الفيديو والترجمات النصية ومزامنة الصوت والفيديو.