このプロジェクトについて

TTS WebUIは、GradioとReactで構築された包括的で統一されたWebアプリケーションであり、多種多様なテキスト読み上げ(TTS)、音声生成、音声変換モデルへのアクセスしやすいインターフェースを提供します。このプロジェクトは、最先端のAIオーディオプロジェクトを単一のまとまりのある環境に統合することを目指しています。 ### 主な機能: - **幅広いモデル互換性**:Bark、Tortoise、MusicGen、MAGNeT、Stable Audio、GPT-SoVITS、CosyVoice、XTTSv2、DIA、Kokoro、OpenVoice、ParlerTTS、StyleTTS2など、多くの人気モデルをサポート。 - **デュアルインターフェース**:Gradioベースのバックエンドインターフェースと、モダンなユーザー体験を提供するReactベースのフロントエンドUIの両方を提供。 - **拡張可能なアーキテクチャ**:統合された拡張マーケットプレイスとマネージャーを備え、ユーザーはコミュニティ拡張機能やカスタムモデルを簡単にインストール、更新、管理できます。 - **APIと統合**:OpenAI互換のAPIを提供し、Silly Tavern、OpenWebUI、Text Generation WebUIなどの外部アプリケーションとの統合が容易です。 - **複数のインストール方法**:Windows用のネイティブインストーラー、Pythonによる手動セットアップ、Dockerコンテナ化による簡単なセルフホスティングをサポート。 このプロジェクトはMITライセンスの下で提供され、生成AI技術のオープンかつ倫理的な使用を促進しています。