Sobre o projeto

TTS WebUI é um aplicativo web abrangente e unificado, construído com Gradio e React, que fornece uma interface acessível para uma ampla variedade de modelos de texto-para-fala (TTS), geração de áudio e conversão de voz. Ele visa reunir numerosos projetos de áudio AI de última geração sob um único teto coeso. ### Principais Recursos: - **Compatibilidade Ampla de Modelos**: Suporta modelos populares como Bark, Tortoise, MusicGen, MAGNeT, Stable Audio, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, StyleTTS2 e muitos outros. - **Interface Dupla**: Oferece tanto uma interface backend baseada em Gradio quanto uma UI frontend baseada em React para uma experiência de usuário moderna. - **Arquitetura Extensível**: Apresenta um mercado e gerenciador de extensões integrado, permitindo que os usuários instalem, atualizem e gerenciem facilmente extensões da comunidade e modelos personalizados. - **API e Integrações**: Fornece uma API compatível com OpenAI, facilitando a integração com aplicativos externos como Silly Tavern, OpenWebUI e Text Generation WebUI. - **Múltiplos Métodos de Instalação**: Suporta instaladores nativos para Windows, configuração manual via Python e conteinerização Docker para fácil auto-hospedagem. O projeto é licenciado sob MIT, promovendo o uso ético e aberto de tecnologias de IA generativa.