FunTTS — это библиотека синтеза речи с унифицированным интерфейсом, поддерживающая бесшовное переключение между различными TTS-движками, генерацию субтитров, многопользовательские диалоги и асинхронную обработку.
Открытый код. Новые возможности.
Находите качественные проекты с открытым исходным кодом, отправляйте проекты анонимно, заявляйте права на свои проекты и редактируйте их.
Немного любопытства. Мир открытого кода.
THE FIRST COLLECTIONИнструмент с открытым исходным кодом для мастеринга и сопоставления аудио, подстраивающий целевой трек под RMS, частотную характеристику, пиковую амплитуду и стереоширину референса. Доступен как Docker-приложение, Python-библиотека и узел ComfyUI.
MPCTK — это набор инструментов на Python для создания, редактирования и генерации проектов Akai MPC Sample (.xpj). Он поддерживает внедрение сэмплов, генерацию расположения пэдов (хроматическое/на основе гаммы), транспозицию и сохраняет структуру проекта. Проверено на реальном оборудовании.
spotDL — это инструмент командной строки, который находит и скачивает песни из плейлистов Spotify через YouTube, включая обложки альбомов, тексты песен и метаданные.
Кроссплатформенное приложение для MIDI-аккордов и музыкальной теории. Включает настольную версию (Python/PySide6), веб-версию (Cloudflare Worker) и мобильную (Flutter). Предлагает гармоническое обнаружение аккордов, генерацию аккордов и гамм.
Telegram-бот для расширения библиотеки Navidrome: загрузка музыки из сервисов, получение FLAC через Soulseek, авто-тегирование, совместное прослушивание, тексты песен и управление коллекцией.
Десктопный инструмент для Path of Exile, позволяющий просматривать персонажей и вкладки сундука через официальный API GGG, с поиском по всей лиге и офлайн-кэшированием.
Python-инструмент для локализации авторизованных видео с YouTube с помощью китайских субтитров и помощи в публикации на Bilibili. Поддерживает транскрибацию речи, OCR, перевод через LLM и рендеринг «вшитых» субтитров.
Skill Seekers — CLI-инструмент для конвертации документации, репозиториев, PDF, видео в AI-скиллы для Claude, Gemini, OpenAI с обнаружением конфликтов и экспортом в 22 формата.
Omi — открытый AI-ассистент, который записывает экран и аудио, транскрибирует разговоры в реальном времени, извлекает действия и сохраняет контекстную историю чата на всех устройствах: десктопах, мобильных и носимых.
Beets — менеджер музыкальной библиотеки на Python: каталогизация коллекций, авто-тегирование через MusicBrainz и другие источники, загрузка обложек, текстов, жанров, применение ReplayGain, поиск дубликатов, транскодирование аудио, веб-интерфейс и совместимость с MPD.
Unsloth — это десктопное приложение и фреймворк для локального запуска и обучения больших языковых моделей (LLM) и диффузионных моделей на Windows, macOS и Linux.
Современный неофициальный редактор и библиотекарь для аппаратного обеспечения Korg microSAMPLER, предназначенный для замены устаревшего 32‑битного ПО на новых операционных системах.
Массовый импорт пресетов VST3/FL Studio в Cableguys ShaperBox 3 на macOS через Pedalboard, минуя ручной ввод. Включает автобэкапы, тестовый запуск и детектирование блокировки DAW.
PyFFmpegCore — это безопасный и объяснимый запускатель задач FFmpeg для терминала, Python и CI, предназначенный заменить хрупкие строки команд на воспроизводимые рабочие процессы автоматизации медиа.
Инструмент для сведения и мастеринга на базе ИИ, включающий десктопное приложение и MCP-сервер для интеграции с Ableton Live.
VoxCPM2 — система синтеза речи с голоса на текст без дискретной токенизации от OpenBMB. 2B-параметровая модель на базе диффузионной авторегрессионной архитектуры поддерживает 30 языков, генерацию речи из текстового описания голоса, контролируемое клонирование и вывод аудио 48 кГц.
Настольный инструмент для обрезки видео и создания GIF, позволяющий пользователям загружать веб‑видео, вырезать нужные фрагменты, добавлять субтитры и экспортировать результат без водяных знаков и учётных записей.
Spleeter — это библиотека для разделения музыкальных источников на основе Python от Deezer Research, которая использует предварительно обученные модели TensorFlow для разделения аудио на отдельные дорожки, такие как вокал, ударные, бас и другие.
yt-dlp — это многофункциональный консольный инструмент для загрузки аудио и видео с тысяч сайтов, являющийся форком проекта youtube-dl.