Об этом проекте

FunTTS представляет собой современную библиотеку инструментов для преобразования текста в речь (TTS) на языке Python, разработанную для упрощения интеграции и переключения между различными TTS-движками с помощью единого API. Она поддерживает множество популярных открытых и коммерческих движков, включая Edge TTS, Azure TTS, Bark, Tortoise, eSpeak, pyttsx3 и другие. Пользователи могут динамически выбирать движок через конфигурационный файл или код, не изменяя основную логику приложения. Библиотека имеет встроенную поддержку трех форматов субтитров — SRT, VTT и FRT, что позволяет автоматически генерировать и синхронизировать временные шкалы. Также поддерживаются сценарии с несколькими дикторами, что облегчает создание диалогового аудиоконтента. Кроме того, FunTTS предоставляет полезные инструменты для объединения аудио, слияния ответов и пакетной обработки, а также поддерживает асинхронные операции для повышения производительности. Структура проекта четко определена и включает базовые абстрактные классы, модели данных, реализации движков и модули утилит, что упрощает добавление новых движков. Способы установки гибкие: поддерживается как установка зависимостей для конкретных движков по мере необходимости, так и полная установка. Подробная документация охватывает конфигурацию каждого движка, примеры использования, устранение неполадок и руководства по разработке, что делает библиотеку подходящей для самых разных сценариев — от личных проектов до приложений корпоративного уровня.