Sobre el proyecto

FireRed-OpenStoryline convierte la creación compleja de videos en conversaciones naturales e intuitivas. El sistema combina búsqueda y organización inteligente de medios (encuentra y descarga automáticamente imágenes/clips de video coincidentes), generación inteligente de guiones con transferencia de estilo few-shot para tonos específicos (reseñas de productos, vlogs, etc.), recomendaciones inteligentes de música/voz en off/fuentes con sincronización de ritmo, refinamiento conversacional para ediciones rápidas mediante lenguaje natural, y archivado de habilidades de edición para guardar y reproducir flujos de trabajo completos como Skills reutilizables. Las adiciones recientes incluyen generación de transiciones con IA (creando tomas de transición a partir de descripciones de fotogramas), habilidad de corte preliminar basada en ASR para videos de habla (eliminando palabras de relleno y disfluencias), e integración con OpenClaw y Claude Code mediante Agent Skills para automatización de instalación y uso. La arquitectura utiliza un servidor de Model Context Protocol (MCP), nodos de procesamiento de video, una biblioteca de agent skills y almacenamiento de memoria del agente. Se basa en MoviePy, FFmpeg y LangChain. La instalación es compatible con Linux/macOS (automatizada mediante build_env.sh), Windows (descarga manual de recursos) y Docker. La interfaz web se ejecuta en FastAPI, con una alternativa de CLI. La configuración requiere claves API en config.toml. Las demos muestran múltiples estilos: Zhongcao, Humorístico, Selecciones de Productos, Artístico, Unboxing, Mascota Parlante, Vlog de Viaje y Resumen Anual. El proyecto está licenciado bajo Apache 2.0 y se desarrolla activamente con una hoja de ruta que incluye edición de voz en off, clonación de voz, más efectos, capacidades generativas y aceleración por GPU.