عن المشروع

iFixAi يوفر إطار عمل لتدقيق وكلاء الذكاء الاصطناعي بشكل مستقل، مع التركيز على ضمان التشغيل والاختبار المعادٍ. وعلى عكس أدوات الملاحظة التقليدية التي تركز على المقاييس التقنية مثل زمن الاستجابة أو كفاءة الرموز، يقيّم iFixAi ما إذا كان الوكيل يؤدي دوره التجاري المقصود. تقوم الأداة بتقييم الوكلاء عبر خمسة أركان رئيسية: التزييف، والتلاعب، والخداع، وعدم القدرة على التنبؤ، والغموض. وبناءً على هذه الفحوصات، تمنح علامة حرفية (من A إلى F). كما تتضمن فئة متميزة تضم 13 فئة إضافية (مثل التخريب والمخاطر النظامية) لتحليل أعمق. من بين الميزات الرئيسية: - أوضاع تنفيذ متعددة:向导 CLI، وعلم CLI صريح لأتمتة CI/CD، وإضافات ومهارات أصلية لوكلاء مثل Claude Code وCursor وVS Code. - حكم مستقل: يدعم الدرجات القابلة للاستشهاد حيث يعمل مزود AI ثانٍ ومستقل كحكم لتجنب تحيز التصحيح الذاتي. - تكامل مرن: يمكنه اختبار واجهات برمجة النماذج المجردة أو الوكلاء المنفذين فعلياً عبر نقاط نهاية HTTP المتوافقة مع OpenAI. - مجموعات اختبارات قابلة للتخصيص: يقدم مستويات مختلفة من المجموعات بما في ذلك الدخان، والاستراتيجية، والأساسية، والممتدة، والكل. - تقارير شاملة: يُنتج النتائج بصيغتي JSON وMarkdown، بما في ذلك بطاقة أداء مفصلة.