عن المشروع
Reinfors هو إطار عمل للتعلم المعزز يقوم بتنفيذ محاكاة اللعبة، والبحث الشجري، وتنسيق الحلقات، وتجميع الدُفعات في خلفية Rust متوازية. الحد الفاصل بين محرك Rust والمستخدم هو استدعاء استدلال: يستقبل ملاحظات مجمعة من NumPy ويعيد مخرجات النموذج، تاركًا بنية الشبكة، وإطار التدريب، والمحسن، ومخزن إعادة التشغيل، ووضع الأجهزة، والطوبولوجيا الموزعة بالكامل تحت سيطرة المتصل.
تتضمن المكتبة كتالوجًا واسعًا من الألعاب التي تغطي مهام اللاعب الواحد والمتعدد اللاعبين، والألعاب ذات المجموع الصفري، والتعاونية، والألعاب ذات المجموع العام، مع دعم للقرارات المتناوبة أو المتزامنة، وأحداث الفرص الصريحة، والمعلومات الكاملة وغير الكاملة على حد سواء. تمتد الخوارزميات لتشمل تعلم القيمة المدفوع بالسياسة، والتعلم الموجه بالبحث، وطرق الحل النظرية للألعاب المستقلة.
التثبيت يتم عبر pip باستخدام `pip install reinfors`، مع خيارات إضافية لمهايئات Gymnasium/PettingZoo (`reinfors[gym]`) وأمثلة تدريب PyTorch (`reinfors[train]`). مثال بسيط ينشئ محرك Connect4 ويجمع دفعات التدريب عن طريق توفير دالة استدلال.
تُظهر المقارنات المعيارية مكاسب كبيرة في الأداء مقارنة بمكتبات التعلم المعزز النقية المستندة إلى Python مثل Gymnasium، مع سرعات مُبلغ عنها تبلغ حوالي 14-20 ضعفًا في خطوة البيئة أحادية الخيط. تستهدف Reinfors أيضًا توازنًا عمليًا بين أداء المحاكاة الأصلي والنمطية للتجريب الواسع عبر الألعاب والخوارزميات والشبكات وتكوينات النشر.
المشروع هو ما قبل الإصدار 1.0، مما يعني أن واجهات برمجة التطبيقات والسلوكيات والتنسيقات المتسلسلة قد تتغير بين إصدارات 0.x دون تحذيرات إهمال. يُنصح المستخدمون بتثبيت إصدارات محددة والاطلاع على ملاحظات الإصدار عند الترقية. وهو مرخص بشكل مزدوج بموجب MIT و Apache-2.0.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.