عن المشروع
Fooocus هو تطبيق مفتوح المصدر لتوليد الصور يعمل دون اتصال، مبني على بنية Stable Diffusion XL ويُقدَّم عبر واجهة ويب Gradio. هدفه التصميمي المعلن هو تمكين المستخدمين من التركيز على الأوامر النصية والصور بدلاً من الضبط اليدوي للمعلمات، على غرار الخدمات المستضافة مثل Midjourney. يصف المشروع محرك معالجة أوامر نصية يعمل دون اتصال مبنيًا على GPT-2 وتحسينات في أخذ العينات تهدف إلى إنتاج نتائج جيدة من أوامر نصية قصيرة أو طويلة.
تشمل القدرات الرئيسية الموصوفة في ملف README: توليد الصور من النص، رفع دقة الصور المدخلة وتوليد أشكال مختلفة منها، ملء الأجزاء المفقودة (inpainting) وتوسيع الصورة خارج حدودها (outpainting) للأعلى/الأسفل/اليسار/اليمين، استخدام الصور كأوامر نصية، استبدال الوجوه عبر InsightFace، وصف الصور، أنماط جاهزة، أوامر سلبية، اختيار نسبة الأبعاد، وترجيح الأوامر النصية باستخدام أسلوب A1111. كما يوثق خوارزمية ونموذج inpainting خاصين به، بالإضافة إلى تبديل مُحسِّن (refiner) أصلي داخل عينة k-sampler واحدة، وتوجيه ADM سلبي، وصيغة من توجيه الانتباه الذاتي.
التثبيت متاح لنظام Windows عبر حزمة قابلة للتنزيل وملف run.bat، ولنظام Linux عبر Anaconda أو Python venv أو Python 3.10 الأصلي، ولبطاقات AMD عبر ROCm أو DirectML (الموصوفة كنسخة تجريبية)، ولأجهزة Mac عبر PyTorch MPS، وعبر Docker. كما يتم توفير دفتر Colab. يذكر ملف README أن الحد الأدنى من المتطلبات هو 4 جيجابايت من ذاكرة Nvidia VRAM و8 جيجابايت من ذاكرة النظام، مع الحاجة إلى ذاكرة تبديل (swap)، ويشير إلى أن التشغيل بوحدة المعالجة المركزية فقط يتطلب 32 جيجابايت من ذاكرة الوصول العشوائي. تتوفر ثلاثة إعدادات مسبقة: افتراضي/عام، واقعي، وأنمي، ولكل منها نماذج وتكوينات افتراضية مختلفة. يمكن كشف الواجهة محليًا باستخدام --listen أو مشاركتها عبر --share، ويمكن إضافة مصادقة أساسية من خلال ملف auth.json.
يُوصف المشروع بأنه في مرحلة دعم محدود طويل الأجل مع إصلاحات للأخطاء فقط، ولا توجد خطط حالية للانتقال إلى بنى نماذج أحدث. يحذر ملف README من وجود العديد من المواقع المزيفة وأن هذا المستودع هو المصدر الرسمي الوحيد.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.