Sobre o projeto
TTS WebUI é um aplicativo web abrangente e unificado, construído com Gradio e React, que fornece uma interface acessível para uma ampla variedade de modelos de texto-para-fala (TTS), geração de áudio e conversão de voz. Ele visa reunir numerosos projetos de áudio AI de última geração sob um único teto coeso.
### Principais Recursos:
- **Compatibilidade Ampla de Modelos**: Suporta modelos populares como Bark, Tortoise, MusicGen, MAGNeT, Stable Audio, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, StyleTTS2 e muitos outros.
- **Interface Dupla**: Oferece tanto uma interface backend baseada em Gradio quanto uma UI frontend baseada em React para uma experiência de usuário moderna.
- **Arquitetura Extensível**: Apresenta um mercado e gerenciador de extensões integrado, permitindo que os usuários instalem, atualizem e gerenciem facilmente extensões da comunidade e modelos personalizados.
- **API e Integrações**: Fornece uma API compatível com OpenAI, facilitando a integração com aplicativos externos como Silly Tavern, OpenWebUI e Text Generation WebUI.
- **Múltiplos Métodos de Instalação**: Suporta instaladores nativos para Windows, configuração manual via Python e conteinerização Docker para fácil auto-hospedagem.
O projeto é licenciado sob MIT, promovendo o uso ético e aberto de tecnologias de IA generativa.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.