À propos du projet

FireRed-OpenStoryline transforme la création vidéo complexe en conversations naturelles et intuitives. Le système combine recherche et organisation intelligentes des médias (trouver et télécharger automatiquement des images/clips vidéo correspondants), génération intelligente de scripts avec transfert de style few-shot pour des tons spécifiques (avis produits, vlogs, etc.), recommandations intelligentes de musique/voix off/polices avec synchronisation des temps, raffinement conversationnel pour des modifications rapides en langage naturel, et archivage des compétences de montage pour enregistrer et rejouer des flux de travail complets en tant que Skills réutilisables. Les ajouts récents incluent la génération de transitions IA (création de plans de transition à partir de descriptions d'images), une compétence de montage brut basée sur l'ASR pour les vidéos de parole (suppression des mots de remplissage et des disfluences), et l'intégration avec OpenClaw et Claude Code via Agent Skills pour l'automatisation de l'installation et de l'utilisation. L'architecture utilise un serveur Model Context Protocol (MCP), des nœuds de traitement vidéo, une bibliothèque de compétences d'agent et un stockage de mémoire d'agent. Elle s'appuie sur MoviePy, FFmpeg et LangChain. L'installation prend en charge Linux/macOS (automatisée via build_env.sh), Windows (téléchargement manuel des ressources) et Docker. L'interface web fonctionne sur FastAPI, avec une alternative CLI. La configuration nécessite des clés API dans config.toml. Les démos présentent plusieurs styles : Zhongcao, Humoristique, Sélections de produits, Artistique, Unboxing, Animal parlant, Vlog de voyage et Rétrospective annuelle. Le projet est sous licence Apache 2.0 et activement développé avec une feuille de route incluant l'édition de voix off, le clonage vocal, davantage d'effets, des capacités génératives et l'accélération GPU.