Об этом проекте

video-use — это open-source проект, который позволяет редактировать видео через кодинговые агенты, такие как Claude Code, Codex или Hermes. Пользователи помещают исходные видеозаписи в папку, общаются с агентом через чат и получают готовый файл final.mp4. Система работает с различными типами контента: говорящая голова, монтажные склейки, обучающие ролики, travel-видео и интервью — без необходимости использовать пресеты или меню. Ключевые возможности: - Удаление слов-паразитов (мм, ээ, оговорки) и пустых промежутков между дублями - Автоматическая цветокоррекция: тёплый кинематографичный стиль, нейтральный контрастный или кастомные ffmpeg-цепочки - Аудио-фейды длительностью 30 мс на каждом склеечном участке для предотвращения акустических щелчков - Встраивание субтитров с настраиваемыми стилями (по умолчанию — двухсловные верхнерегистровые блоки) - Генерация анимационных оверлеев через HyperFrames, Remotion, Manim или PIL с запуском параллельных суб-агентов - Самостоятельная оценка рендер-выхода на каждой границе склейки перед показом результата - Сохранение контекста сессии в project.md для непрерывности между сессиями Система работает по принципу чтения видео через два слоя вместо прямого просмотра. Слой 1 — аудио-транскрипт от ElevenLabs Scribe с пословными таймкодами, диаризацией говорящих и аудио-событиями, упакованный в текстовый файл ~12 КБ. Слой 2 — визуальный композит по запросу (плёночная лента + волновая форма + метки слов в формате PNG), генерируемый только в точках принятия решений. Такой подход позволяет избежать обработки миллионов токенов сырых кадров. Пайплайн строится так: Транскрипция → Упаковка → Анализ LLM → EDL → Рендер → Самооценка, с циклом самодиагностики, который проверяет результат на каждом границе склейки и может исправить ошибки до 3 раз перед показом превью. Установка возможна через paste-in промпт для автоматической настройки или вручную: клонирование репозитория, установка зависимостей (uv/pip, ffmpeg, yt-dlp) и добавление API-ключа ElevenLabs. Принцип проектирования делает ставку на текст и визуалы по запросу, приоритет аудио с последующей визуализацией, согласование стратегии перед выполнением, отсутствие допущений о контенте и 12 жёстких правил производства при сохранении художественной свободы в остальных аспектах.