Об этом проекте

TTS WebUI — это комплексное унифицированное веб-приложение, созданное с использованием Gradio и React, которое предоставляет доступный интерфейс для широкого спектра моделей синтеза речи (TTS), генерации аудио и конвертации голоса. Его цель — объединить множество передовых проектов в области ИИ-аудио под одной крышей. ### Ключевые особенности: - **Широкая совместимость с моделями**: Поддерживает популярные модели, такие как Bark, Tortoise, MusicGen, MAGNeT, Stable Audio, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, StyleTTS2 и многие другие. - **Двойной интерфейс**: Предлагает как бэкенд-интерфейс на основе Gradio, так и фронтенд-интерфейс на React для современного пользовательского опыта. - **Расширяемая архитектура**: Включает встроенный маркетплейс расширений и менеджер, позволяющий пользователям легко устанавливать, обновлять и управлять расширениями сообщества и пользовательскими моделями. - **API и интеграции**: Предоставляет API, совместимый с OpenAI, что упрощает интеграцию с внешними приложениями, такими как Silly Tavern, OpenWebUI и Text Generation WebUI. - **Несколько способов установки**: Поддерживает нативные установщики для Windows, ручную настройку через Python и контейнеризацию Docker для простого самостоятельного хостинга. Проект распространяется под лицензией MIT, способствуя открытому и этичному использованию технологий генеративного ИИ.