इस प्रोजेक्ट के बारे में
FireRed-OpenStoryline जटिल वीडियो निर्माण को प्राकृतिक, सहज बातचीत में बदल देता है। यह सिस्टम स्मार्ट मीडिया खोज और संगठन (स्वचालित रूप से मेल खाते इमेज/वीडियो क्लिप ढूंढना और डाउनलोड करना), विशिष्ट टोन (उत्पाद समीक्षा, व्लॉग, आदि) के लिए फ्यू-शॉट स्टाइल ट्रांसफर के साथ बुद्धिमान स्क्रिप्ट जनरेशन, बीट-सिंकिंग के साथ बुद्धिमान संगीत/वॉयसओवर/फ़ॉन्ट अनुशंसाएँ, प्राकृतिक भाषा के माध्यम से त्वरित संपादन के लिए संवादात्मक परिशोधन, और संपादन कौशल संग्रहण (पूर्ण वर्कफ़्लो को पुन: प्रयोज्य स्किल्स के रूप में सहेजना और चलाना) को जोड़ता है।
हाल के जोड़ों में AI ट्रांज़िशन जनरेशन (फ्रेम विवरण से ट्रांज़िशन शॉट बनाना), भाषण वीडियो के लिए ASR-आधारित रफ कट स्किल (फिलर शब्द और अस्पष्टताएँ हटाना), और इंस्टॉलेशन/उपयोग स्वचालन के लिए Agent Skills के माध्यम से OpenClaw और Claude Code के साथ एकीकरण शामिल हैं।
आर्किटेक्चर एक Model Context Protocol (MCP) सर्वर, वीडियो प्रोसेसिंग नोड्स, एक एजेंट स्किल्स लाइब्रेरी, और एजेंट मेमोरी स्टोरेज का उपयोग करता है। यह MoviePy, FFmpeg, और LangChain पर आधारित है। इंस्टॉलेशन Linux/macOS (build_env.sh के माध्यम से स्वचालित), Windows (मैनुअल रिसोर्स डाउनलोड), और Docker का समर्थन करता है। वेब इंटरफ़ेस FastAPI पर चलता है, CLI विकल्प के साथ। कॉन्फ़िगरेशन के लिए config.toml में API कुंजियाँ आवश्यक हैं।
डेमो कई शैलियाँ दिखाते हैं: Zhongcao, Humorous, Product Picks, Artistic, Unboxing, Talking Pet, Travel Vlog, और Year-in-Review। परियोजना Apache 2.0 लाइसेंस के तहत है और सक्रिय रूप से विकसित हो रही है, जिसमें वॉयसओवर संपादन, वॉयस क्लोनिंग, अधिक प्रभाव, जनरेटिव क्षमताएँ, और GPU त्वरण शामिल हैं।
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.