Об этом проекте

OpenCreator (ранее KrillinAI) — это открытая ИИ-рабочая среда, объединяющая мультимодальное создание контента и универсальное рабочее пространство агентов. В её основе лежит Codex CLI как движок выполнения, вокруг которого построены локальный Runtime, визуальная рабочая среда и десктопный хост. Продукт связывает два взаимосвязанных workflow: 1. Создание ИИ-контента: специализированные инструменты для перевода видео, загрузки видео, генерации превью, генерации изображений, умного дублирования и генерации видео. 2. Универсальное рабочее пространство агента: группировка диалогов по проектам, фоновый запуск Run, управление подтверждениями, вложениями, файлами, Skills, MCP, расписаниями, уведомлениями, памятью и диагностикой. Доступные инструменты создателя: - Перевод видео: импорт локальных или публичных видео, транскрибация через облачные или локальные Whisper, сегментация/выравнивание/терминология/перевод субтитров с LLM, настройка двуязычных субтитров, дубляж, стили субтитров, экспорт SRT/аудио/видео. - Загрузчик видео: разбор ссылок YouTube, Bilibili и других публичных платформ, просмотр вариантов качества и формата, загрузка видео или аудио. - Генератор превью: комбинация темы, ссылки на видео и опционального референсного изображения для генерации нескольких вариантов превью. - Генератор изображений: создание по промптам и опциональным референсным изображениям, настройка соотношения сторон и количества выводов. - Умный дубляж: конвертация сценариев в голос с выбором голоса, темпа и эмоций. - Генератор видео: создание видео через Seedance из промптов и референсных изображений. В разработке: анимация stick figure, автоклипы и цифровой аватар. Рабочее пространство и диалог агента используют единый конечный автомат, синхронизируя шаги, прогресс и результаты. Каждая ревизия создаёт новую версию, не перезаписывая предыдущие. Поддерживаются глобальная, проектная и потоковая память с воспроизводимыми снимками входных данных Run. Поддерживаемые модели: языковые (GPT, DeepSeek, Qwen, Kimi, GLM, Grok, Doubao, ERNIE, Hunyuan), изображения (GPT Image), видео (Seedance), голос/транскрибация (Whisper, OpenAI TTS, MiniMax, Edge TTS, Aliyun Speech). Архитектура: фронтенд на React 18/Vite/TypeScript, локальный демона на Fastify, десктопный хост на Electron, медиатрубопровод с yt-dlp, FFmpeg и Whisper. Данные хранятся локально через SQLite и файловую систему, учётные данные — в системном хранилище. Проект лицензирован под Apache 2.0.