Sobre el proyecto
TTS WebUI es una aplicación web integral y unificada construida con Gradio y React que proporciona una interfaz accesible para una amplia variedad de modelos de síntesis de texto a voz (TTS), generación de audio y conversión de voz. Su objetivo es reunir numerosos proyectos de audio con IA de última generación bajo un mismo techo cohesivo.
### Características principales:
- **Amplia compatibilidad de modelos**: Admite modelos populares como Bark, Tortoise, MusicGen, MAGNeT, Stable Audio, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, StyleTTS2 y muchos más.
- **Interfaz dual**: Ofrece tanto una interfaz backend basada en Gradio como una interfaz frontend basada en React para una experiencia de usuario moderna.
- **Arquitectura extensible**: Cuenta con un mercado y administrador de extensiones integrado, lo que permite a los usuarios instalar, actualizar y gestionar fácilmente extensiones de la comunidad y modelos personalizados.
- **API e integraciones**: Proporciona una API compatible con OpenAI, lo que facilita la integración con aplicaciones externas como Silly Tavern, OpenWebUI y Text Generation WebUI.
- **Múltiples métodos de instalación**: Admite instaladores nativos para Windows, configuración manual mediante Python y contenedores Docker para un autoalojamiento sencillo.
El proyecto está licenciado bajo MIT, promoviendo el uso abierto y ético de las tecnologías de IA generativa.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.