مشروع تعليمي لتدريب نموذج لغة GPT صغير (~540 مليون معامل) من الصفر على أجهزة المستهلك، مع تدريب مسبق على Fineweb-edu وإمكانية ضبط دقيق للمحادثة.
مصدر مفتوح. آفاق جديدة.
اكتشف مشاريع مفتوحة المصدر عالية الجودة، وأرسل المشاريع بشكل مجهول، وطالب بمشروعك المفتوح المصدر وحرّره.
فضول صغير. عالم من المصادر المفتوحة.
THE FIRST COLLECTIONvLLM هي مكتبة عالية الإنتاجية وفعالة في استهلاك الذاكرة، مصممة لاستنتاج ونشر النماذج اللغوية الكبيرة (LLM).
تنفيذ عالي الأداء بلغة C/C++ لاستنتاج نموذج OpenAI Whisper للتعرف التلقائي على الكلام (ASR)، مصمم للنشر الخفيف وعبر المنصات المختلفة.
PaddleSeg هي مجموعة تطوير شاملة لتجزئة الصور من طرف إلى طرف ضمن منظومة PaddlePaddle، تتضمن أكثر من 45 خوارزمية نموذجية و140+ نموذجاً مدرباً مسبقاً، تغطي التجزئة الدلالية والتفاعلية والشاملة واقتطاع الصور والتجزئة الطبية ثلاثية الأبعاد، وتدعم التشغيل القائم على التكوين واستدعاء API، وتغطي سير العمل الكامل من وضع العلامات إلى النشر.
إعادة تنفيذ سريعة لنموذج OpenAI Whisper باستخدام CTranslate2، مما يوفر سرعة تحويل أعلى واستهلاكاً أقل للذاكرة.
Transformers هو إطار عمل لتعريف النماذج مخصص لمهام التعلم الآلي عبر النصوص والرؤية والصوت والمهام متعددة الوسائط. يوفر واجهة برمجة تطبيقات موحدة للاستدلال والتدريب مع الوصول إلى أكثر من مليون نقطة تفتيش مدربة مسبقاً.
SGLang هو إطار عمل عالي الأداء لتقديم النماذج اللغوية الكبيرة (LLMs) والنماذج متعددة الوسائط، مصمم لتحقيق استدلال يتميز بزمن وصول منخفض وإنتاجية عالية.
مجموعة من تنفيذات باي توتش البسيطة للشبكات العصبية واوراق التعلم العميق مع شروحات جانبية موثقة، تغطي المحولات وGANs ونماذج الانتشار والتعلم المعزز والمحسنات وغيرها.