معيار مفتوح لهلوسة نماذج اللغة الكبيرة (LLMs) حول BNCC (القاعدة الوطنية المشتركة للمناهج الدراسية في البرازيل). يقيس مدى اختلاق النماذج للأكواد والنصوص الرسمية، بمنهجية وبيانات خام ومراقبة مستمرة (CI) قابلة للتدقيق.
مصدر مفتوح. آفاق جديدة.
اكتشف مشاريع مفتوحة المصدر عالية الجودة، وأرسل المشاريع بشكل مجهول، وطالب بمشروعك المفتوح المصدر وحرّره.
فضول صغير. عالم من المصادر المفتوحة.
THE FIRST COLLECTIONملف تعريف GitHub لـ Sachin، وهو مهندس ومعماري في مجال الذكاء الاصطناعي التطبيقي. يستعرض مشاريع مفتوحة المصدر في مجالات الوكلاء، واسترجاع البيانات (RAG)، وأدوات التقييم والموثوقية، بالإضافة إلى مهاراته وطرق التواصل معه.
AgentLeak هي أداة اختبار خصوصية مفتوحة المصدر لوكلاء الذكاء الاصطناعي. تكشف تسرب البيانات عبر استدعاءات الأدوات والذاكرة والسجلات باستخدام SDK بايثون محلي وCLI وأدوات MCP، مع تقارير محجوبة وبوابات CI دون تبعيات سحابية.
MLflow هي منصة هندسة ذكاء اصطناعي مفتوحة المصدر مصممة لإدارة دورة حياة الوكلاء، ونماذج LLMs، ونماذج ML التقليدية، مع التركيز على القابلية للملاحظة والتقييم والنشر.
SUM هي أداة مفتوحة المصدر للتحقق من تحويلات النصوص بالذكاء الاصطناعي باستخدام إيصالات تشفيرية. تتحقق مما تغيّر، وما تم الحفاظ عليه، وما فُقد عند إعادة كتابة النص بواسطة الذكاء الاصطناعي، مع توقيعات Ed25519 عبر بيئات التشغيل والتحقق دون اتصال.
garak هو ماسح ضوئي مفتوح المصدر لثغرات نماذج اللغة الكبيرة من NVIDIA يفحص نماذج الذكاء الاصطناعي التوليدي بحثاً عن الهلوسة وتسريب البيانات وحقن الأوامر والسمية والهروب من القيود وغيرها من نقاط الضعف، على غرار nmap أو Metasploit لكن لنماذج اللغة الكبيرة.
iFixAi هو أداة تدقيق مستقلة لوكلاء الذكاء الاصطناعي تقيّم مدى التزام الوكيل بمؤشرات الأداء الرئيسية هيكل تنظيمي من خلال نظام نقاط.
DeepEval هو إطار عمل مفتوح المصدر لتقييم نماذج اللغات الكبيرة (LLM)، مصمم لاختبار تطبيقات الذكاء الاصطناعي، بما في ذلك خطوط أنابيب RAG والوكلاء وروبوتات الدردشة، مما يتيح للمطورين إجراء اختبارات شاملة للجودة.