عن المشروع

Clousight Bench هو مشغل اختبارات معيارية (benchmark runner) وSDK للإضافات مفتوح النواة مصمم لقياس خدمات الحوسبة السحابية. وهو يركز على إمكانية إعادة الإنتاج والشفافية من خلال استخدام أدوات اختبار معيارية أصلية غير معدلة والحفاظ على سلسلة منشأ يمكن التحقق منها لكل قياس. تدعم الأداة حالياً خمس فئات من المنتجات: - بيئات تشغيل الوكلاء (Agent Runtimes): SWE-bench - مستودعات البيانات (Data Warehouses): TPC-H, TPC-DS - قواعد البيانات المعاملاتية (Transactional Databases): TPC-C (عبر BenchBase) - مخازن المفتاح-القيمة (Key-Value Stores): YCSB - نقاط نهاية النماذج اللغوية الكبيرة (LLM Endpoints): MMLU, GSM8K, HumanEval تشمل الميزات المعمارية الرئيسية نظاماً قائماً على الإضافات لـ BenchmarkSuites وEvaluators وDomainPacks وProviderAdapters. كما يدعم أوضاع تنفيذ متنوعة، بما في ذلك وضع 'mock' للاختبار المحلي دون الحاجة إلى حسابات سحابية، ووضع 'real' للبيئات السحابية الحية (مع دعم تجريبي لـ Aliyun AgentRun). يتضمن المشروع عارض ويب يعتمد على React لتحليل السجلات والمسارات، وواجهة استعلام تعتمد على SQL عبر DuckDB، وتكاملاً مع pytest لبوابات CI/CD. كما يتتبع أبعاداً متعددة بما في ذلك زمن الاستجابة والتكلفة وسلوك التوفير (provisioning) جنباً إلى جنب مع الحكم النهائي للاختبار المعياري.