프로젝트 소개

TTS WebUI는 Gradio와 React로 구축된 종합적이고 통합된 웹 애플리케이션으로, 다양한 텍스트 음성 변환(TTS), 오디오 생성, 음성 변환 모델에 대한 접근 가능한 인터페이스를 제공합니다. 이 프로젝트는 수많은 최첨단 AI 오디오 프로젝트를 하나의 일관된 플랫폼으로 통합하는 것을 목표로 합니다. ### 주요 기능: - **광범위한 모델 호환성**: Bark, Tortoise, MusicGen, MAGNeT, Stable Audio, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, StyleTTS2 등 인기 모델을 지원합니다. - **이중 인터페이스**: 현대적인 사용자 경험을 위해 Gradio 기반 백엔드 인터페이스와 React 기반 프론트엔드 UI를 모두 제공합니다. - **확장 가능한 아키텍처**: 통합 확장 마켓플레이스와 관리자를 갖추어 사용자가 커뮤니티 확장 및 사용자 정의 모델을 쉽게 설치, 업데이트, 관리할 수 있습니다. - **API 및 통합**: OpenAI 호환 API를 제공하여 Silly Tavern, OpenWebUI, Text Generation WebUI와 같은 외부 애플리케이션과 쉽게 통합할 수 있습니다. - **다중 설치 방법**: Windows용 네이티브 설치 프로그램, Python을 통한 수동 설정, Docker 컨테이너화를 지원하여 자체 호스팅이 용이합니다. 이 프로젝트는 MIT 라이선스로 배포되며, 생성형 AI 기술의 개방적이고 윤리적인 사용을 촉진합니다.