عن المشروع

TTS WebUI هو تطبيق ويب شامل وموحد مبني باستخدام Gradio وReact، يوفر واجهة سهلة الاستخدام لمجموعة واسعة من نماذج تحويل النص إلى كلام (TTS)، وتوليد الصوت، وتحويل الصوت. يهدف إلى جمع العديد من مشاريع الذكاء الاصطناعي الصوتية الحديثة تحت سقف واحد متماسك. ### الميزات الرئيسية: - **توافق واسع مع النماذج**: يدعم نماذج شائعة مثل Bark، Tortoise، MusicGen، MAGNeT، Stable Audio، GPT-SoVITS، CosyVoice، XTTSv2، DIA، Kokoro، OpenVoice، ParlerTTS، StyleTTS2، وغيرها الكثير. - **واجهة مزدوجة**: يوفر واجهة خلفية قائمة على Gradio وواجهة أمامية قائمة على React لتجربة مستخدم حديثة. - **بنية قابلة للتوسيع**: يتضمن سوقًا ومديرًا متكاملين للإضافات، مما يسمح للمستخدمين بتثبيت وتحديث وإدارة الإضافات المجتمعية والنماذج المخصصة بسهولة. - **واجهات برمجة وتكاملات**: يوفر واجهة برمجة تطبيقات متوافقة مع OpenAI، مما يسهل التكامل مع التطبيقات الخارجية مثل Silly Tavern وOpenWebUI وText Generation WebUI. - **طرق تثبيت متعددة**: يدعم مثبتات أصلية لنظام Windows، والإعداد اليدوي عبر Python، والحاويات عبر Docker لسهولة الاستضافة الذاتية. المشروع مرخص بموجب MIT، مما يعزز الاستخدام المفتوح والأخلاقي لتقنيات الذكاء الاصطناعي التوليدية.