عن المشروع

MoziAI-35B-V3.8 هو نموذج لغوي كبير متعدد الوسائط مفتوح المصدر قابل للنشر محليًا، طوره فريق تشن يومو. يعتمد على قاعدة Ornith-1.5-35B-A3B (معمارية Qwen3.5/3.6-35B-A3B، MoE مع 256 خبير توجيه بالإضافة إلى خبير مشترك واحد، مع 8 خبراء نشطين لكل رمز) ويُوزَّع كملف GGUF للاستخدام مع llama.cpp وOllama وLM Studio وJan. الميزة الرئيسية هي تقنية التكميم الهجين MoziSmartBit المطورة ذاتيًا، والتي تضغط نموذج MoE بمعاملات 35B إلى حوالي 15.9 جيجابايت — أصغر بنحو 30% من بناء Q4_K_M القياسي (~22 جيجابايت) — مع الحفاظ على حوالي 99% من دقة FP16 وفقًا للتقارير. يدعم النموذج نافذة سياق 256K (262,144 رمزًا)، ورؤية متعددة الوسائط عبر ملف إسقاط منفصل mmproj، واستدعاء أدوات أصلي. يذكر ملف README سرعات استدلال تزيد عن 140 رمزًا/ثانية على AMD R9700 وأكثر من 70 رمزًا/ثانية على AMD MAX+395 iGPU عند تفعيل فك الترميز التخميني. يتم وصف آليتين للاستدلال. الأولى هي إطار تفكير ديناميكي بسبعة أبعاد يتوسع من إجابة سريعة ثنائية الأبعاد للأسئلة البسيطة إلى تمرير استدلال عميق كامل بسبعة أبعاد للمهام المعقدة في التطوير والاستراتيجية، ويتم تفعيله عبر علامة moziAI-Think. الثانية هي آلية تكرار Agent LOOP التي تشغل دورة تنفيذ ثم تحقق من جولتين على المهام المعقدة، مع تخطيها تلقائيًا للاستعلامات البسيطة. يتم حقن كلتيهما عبر قالب محادثة Jinja مخصص يجب تحميله مع أوزان النموذج. يُوضع النموذج كمساعد مالي متخصص، مع قدرات موثقة في تحليل السوق، وتفسير الأرباح والأبحاث، ومراجعة المخاطر والامتثال، وتصميم الاستراتيجيات الكمية، واستدعاء أدوات قابلة للتوصيل لبيانات السوق الحية وقواعد البيانات واسترجاع الأبحاث. كما يعلن عن دعم عام للبرمجة والكتابة وتعدد اللغات عبر 201 لغة، بالإضافة إلى وضع إخراج غير مقيد موروث من النموذج الأساسي. يتطلب النشر ثلاثة ملفات: ملف GGUF الرئيسي في جذر المستودع، ومشغل الرؤية تحت mmproj/35B/، وقالب المحادثة تحت V3.8/. يوفر README أوامر تشغيل llama-server الدنيا والكاملة، ومعلمات أخذ عينات موصى بها (درجة حرارة 0.6–0.8، top_p 0.95، top_k 20، min_p 0.024)، وإرشادات VRAM — 20 جيجابايت لسياق 150K مع الرؤية، و24 جيجابايت لسياق 256K كامل مع الرؤية، و32 جيجابايت أو أكثر لهامش أقصى. يتم عرض نشر Ollama عبر ملف Modelfile، على الرغم من أن README يلاحظ أن دعم Ollama لـ mmproj وقالب المحادثة محدود مقارنة بـ llama.cpp. تُقدم معايير مقارنة ضد Ornith-1.0-35B-A3B وQwen3.6-35B-A3B وGemma-4-31B وMuse-Glimmer-30B وQwen3.5-397B عبر مجموعات البرمجة (Terminal-Bench، متغيرات SWE-bench، NL2Repo)، والاستدلال (HLE، GPQA Diamond)، والوكيل (MCP-Atlas، Toolathlon، WideSearch، BrowseComp، ClawEval). الترخيص هو ترخيص MoziAI Model License مخصص مع مكونات Apache-2.0 من Qwen3.5/3.6 وGemma 4، ويُذكر أن النموذج مجاني للاستخدام التجاري.