Duix.Avatar هو أداة مفتوحة المصدر لتوليد الفيديوهات الرقمية واستنساخ الأفاتار دون اتصال بالإنترنت، تدعم التوليد المدفوع بالنص/الصوت مع دعم متعدد اللغات.
مصدر مفتوح. آفاق جديدة.
اكتشف مشاريع مفتوحة المصدر عالية الجودة، وأرسل المشاريع بشكل مجهول، وطالب بمشروعك المفتوح المصدر وحرّره.
فضول صغير. عالم من المصادر المفتوحة.
THE FIRST COLLECTIONكوجفيديوX هو نموذج مفتوح المصدر لتوليد الفيديو يدعم تحويل النص إلى فيديو، الصورة إلى فيديو، واستكمال الفيديو، ويشمل نماذج 2B و5B مع دعم أطر Diffusers وSAT، مع إمكانيات تشغيل على بطاقات GPU متوسطة، وتدريب LoRA، ودعم DDIM، مع إصدارات مجانية على Colab.
ViMax هو إطار عمل مفتوح المصدر لتوليد الفيديو بواسطة وكلاء ذكاء اصطناعي، طوره HKUDS. يقوم بأتمتة خط إنتاج الفيديو من البداية إلى النهاية، بدءًا من المدخل السردي وحتى الفيديو النهائي، بدمج أدوار المخرج، والكاتب، والمنتج، ومولد الفيديو في سير عمل واحد.
Toonflow منصة إنتاج ذكاء اصطناعي مفتوحة المصدر للمسلسلات القصيرة، تغطي الدورة الكاملة من استيراد الروايات إلى إنتاج الفيديو، وتدعم لوحة الرسم اللامحدودة ونظام تعاون الوكيلات ثلاثي الطبقات.
Pixelle-Video هو محرك مفتوح المصدر لتوليد مقاطع الفيديو القصيرة بالكامل بواسطة الذكاء الاصطناعي، حيث يقوم تلقائيًا بكتابة النصوص وتوليد الصور/الفيديو وتوليف الصوت والموسيقى وتركيب الفيديو النهائي.
OpenMontage هو نظام إنتاج فيديو وكيل مفتوح المصدر يحول مساعدي البرمجة بالذكاء الاصطناعي إلى استوديوهات فيديو متكاملة، ويدعم مسارات عمل شاملة من البحث حتى الرندرة النهائية.
LivePortrait هو تنفيذ مفتوح المصدر بلغة PyTorch لتحريك الصور الشخصية بكفاءة، ويدعم البشر والقطط والكلاب. يوفر أوضاع التشغيل المدفوعة بالصور والفيديو، وضوابط الخياطة وإعادة التوجيه، وقوالب الحركة، وواجهة Gradio، وأوزانًا مُدربة مسبقًا.
HunyuanVideo هو نموذج مفتوح المصدر لتوليد الفيديو من النصوصطورته Tencent، يتميز بهيكلية موحدة للصور والفيديو و-VAE ثلاثي الأبعاد وقدرات إعادة كتابة المطالب.
Wan2.2 هو مجموعة نماذج مفتوحة المصدر لتوليد الفيديو من تطوير Wan-AI، تدعم توليد الفيديو من النص والصوت والصور وتحريك الشخصيات باستخدام بنية MoE وجودة 720P.
SANA هي عائلة مفتوحة المصدر من NVIDIA لنماذج الانتشار الفعالة لتوليد الصور والفيديو عالي الدقة، مع كود التدريب والاستدلال، والانتباه الخطي، وضغط DC-AE، والنشر بدقة 4 بت.