عن المشروع
ComfyUI هو محرك ذكاء اصطناعي قوي مصمم للمحترفين البصريين، حيث يوفر واجهة قائمة على العقد المعيارية تتيح تحكماً دقيقاً في النماذج والمعلمات والمخرجات. وهو يدعم مجموعة واسعة من المهام التوليدية بما في ذلك تحويل النص إلى صورة، وتحرير الصور، وتوليد الفيديو، وتوليد الصوت، والرؤية ثلاثية الأبعاد.
تشمل القدرات الرئيسية ما يلي:
- تصميم سير عمل مرئي: بناء وإعادة استخدام تدفقات عمل معقدة لإنتاج الوسائط دون كتابة أكواد برمجية باستخدام رسم بياني للعقد.
- دعم واسع للنماذج: دعم أصلي للعديد من النماذج مثل Stable Diffusion (1.5, SDXL, SD3.5)، وFlux.1، وWan، وHunyuan، ومختلف نماذج LLMs مثل Gemma وQwen.
- تحسين الأداء: يتميز بجدولة غير متزامنة، وإدارة ذكية لذاكرة VRAM/RAM، وتفريغ النماذج (model offloading)، ودعم النماذج المكممة (quantized models).
- التكامل الإنتاجي: يوفر نقاط نهاية API لتكامل خطوط الإنتاج و"وضع التطبيق" (App Mode) لتبسيط تدفقات العمل المعقدة إلى واجهة مستخدم أساسية.
- القابلية للتوسع: يدعم العقد المخصصة وإضافة ComfyUI-Manager لتسهيل تثبيت وتحديث العقد التي يصنعها المجتمع.
- التوفر عبر المنصات: يعمل على Windows وLinux وmacOS، ويدعم مجموعة متنوعة من الأجهزة بما في ذلك NVIDIA وAMD وIntel وApple Silicon وAscend NPUs وCambricon MLUs.
- التعامل مع الوسائط: يدعم الصور ذات عمق البت العالي (16-bit PNG, 32-bit EXR) وتنسيقات فيديو HDR.