Об этом проекте

FlowCraft — это визуальный конструктор рабочих процессов с открытым исходным кодом, предназначенный для генерации контента на основе ИИ с использованием моделей Google Gemini. Он позволяет пользователям создавать сложные мультимодальные процессы, соединяя различные типы узлов через интуитивно понятный интерфейс перетаскивания, в конечном итоге генерируя текст, изображения и видео. **Основные возможности** Платформа включает визуальный конструктор рабочих процессов на основе @xyflow/react, позволяющий проектировать масштабируемые ИИ-процессы без написания кода. Она предлагает первоклассную интеграцию с генеративными моделями Google, включая Gemini 3 Pro и 3 Flash для генерации текста, Nano Banana Pro (Gemini 3 Pro Image Preview) и Gemini 2.5 Flash Image для генерации изображений, а также Veo 3.1 для генерации видео. Рабочие процессы могут выполняться в реальном времени с визуальной обратной связью и отслеживанием прогресса, а параллельный движок обработки автоматически разрешает зависимости и определяет оптимальные пути выполнения. **Встроенные типы узлов** FlowCraft поставляется с полным набором встроенных узлов: - **Узел LLM (Agent)**: генерация текста на основе Gemini с поддержкой текстовых и файловых входов, настраиваемых инструментов, системных инструкций, строгого JSON-вывода и визуального конструктора схем. - **Узел Image**: генерирует изображения с помощью Gemini 3 Pro Image Preview или Gemini 2.5 Flash Image с настраиваемыми соотношениями сторон, референсами и разрешениями. - **Узел Video**: на основе Veo 3.1 (модели Fast и Pro) генерирует видео длительностью 4, 6 или 8 секунд из текстовых подсказок, опционально используя первый/последний кадры или референсные изображения из связанных узлов. - **Узел File**: управляет и предпросматривает файлы, включая PDF, изображения и видео, подключаемые к узлам LLM и Vision через URI Google Cloud Storage. - **Узел Text**: простое многострочное текстовое поле для подсказок и инструкций. - **Узел Upscale**: увеличивает сгенерированные изображения до 4x с помощью Imagen 4.0. - **Узел Resize**: интеллектуально изменяет размер или обрезает изображения до новых соотношений сторон. - **Узел Custom Workflow**: встраивает ранее сохраненные процессы как модульные, переиспользуемые пользовательские узлы. - **Узлы Input/Output**: определяют границы данных для пользовательских рабочих процессов. **Расширенные функции** Движок рабочих процессов (workflow-engine.ts) рекурсивно обрабатывает графы выполнения с параллельной обработкой. Динамическая панель конфигурации позволяет пользователям настраивать параметры, такие как модель генерации, системные инструкции, длительность видео и разрешение медиа, в реальном времени с боковой панели. Встроенная аутентификация использует Google OAuth через next-auth, а медиапросмотрщик позволяет просматривать сгенерированные ресурсы непосредственно в графе. **Технологический стек** Фронтенд: Next.js 16.1 (App Router), React 19, TypeScript, Tailwind CSS 4.1.18, @xyflow/react 12.10, shadcn/ui (Radix UI + Tailwind) и Zustand для управления состоянием на клиенте. Бэкенд: Node.js с серверными функциями Next.js, Google GenAI SDK для взаимодействия с Vertex AI, Terraform для инфраструктуры как кода, Google Cloud Run для контейнерного хостинга, Google Cloud Storage для хранения артефактов, Google Cloud Firestore для NoSQL-базы данных в реальном времени и Winston для стандартизированного логирования. **Поддерживаемые модели ИИ** - Текст: gemini-3.1-pro-preview, gemini-3.5-flash, gemini-3.1-flash-lite - Изображения: imagen-4.0-upscale-preview, gemini-2.5-flash-image, gemini-3-pro-image, gemini-3.1-flash-image, gemini-3.1-flash-lite-image - Видео: veo-3.1-lite-generate-001, veo-3.1-fast-generate-001, veo-3.1-generate-001, gemini-omni-flash-preview **Развертывание** Проект использует Terraform для предоставления и управления инфраструктурой Google Cloud. Скрипт развертывания (scripts/deploy.sh) оркестрирует инициализацию Terraform, планирование сборки и применение для предоставления ресурсов GCP, сборку Docker-образов через Cloud Build и развертывание в Cloud Run. Предварительные требования включают Node.js 18+, проект Google Cloud с включенным Vertex AI, базу данных Firebase/Firestore и корзину GCS. **Варианты использования** FlowCraft поддерживает сложные мультимодальные процессы, такие как объединение текстового агента для мозгового штурма на Gemini в блок генерации изображений Imagen 4.0, изменение размера изображения 16:9 до 9:16 для TikTok и передача его в качестве первого кадра в генерацию видео Veo 3.1, или предоставление длинного PDF пользовательскому узлу Summarizer, который внутренне выполняет подпроцессы map-reduce. Проект лицензирован под Apache 2.0 и приветствует вклад через стандартный процесс fork-branch-commit-PR.