OPEN SOURCE, OPEN TO EVERYONE

مصدر مفتوح. آفاق جديدة.

اكتشف مشاريع مفتوحة المصدر عالية الجودة، وأرسل المشاريع بشكل مجهول، وطالب بمشروعك المفتوح المصدر وحرّره.

اختيار بشري · اكتشف مصادر مفتوحة جيدة4109تم اكتشافها

فضول صغير. عالم من المصادر المفتوحة.

THE FIRST COLLECTION
Topic: llm-evaluation清除
جديد

معيار مفتوح لهلوسة نماذج اللغة الكبيرة (LLMs) حول BNCC (القاعدة الوطنية المشتركة للمناهج الدراسية في البرازيل). يقيس مدى اختلاق النماذج للأكواد والنصوص الرسمية، بمنهجية وبيانات خام ومراقبة مستمرة (CI) قابلة للتدقيق.

الذكاء الاصطناعيTraining & evaluation
sachncssachncs
جديد

ملف تعريف GitHub لـ Sachin، وهو مهندس ومعماري في مجال الذكاء الاصطناعي التطبيقي. يستعرض مشاريع مفتوحة المصدر في مجالات الوكلاء، واسترجاع البيانات (RAG)، وأدوات التقييم والموثوقية، بالإضافة إلى مهاراته وطرق التواصل معه.

الذكاء الاصطناعيأدوات التطويرAI agents
agentleakyagobski
جديد

AgentLeak هي أداة اختبار خصوصية مفتوحة المصدر لوكلاء الذكاء الاصطناعي. تكشف تسرب البيانات عبر استدعاءات الأدوات والذاكرة والسجلات باستخدام SDK بايثون محلي وCLI وأدوات MCP، مع تقارير محجوبة وبوابات CI دون تبعيات سحابية.

أدوات التطويرالذكاء الاصطناعيTesting & debugging
mlflowmlflow
جديد

MLflow هي منصة هندسة ذكاء اصطناعي مفتوحة المصدر مصممة لإدارة دورة حياة الوكلاء، ونماذج LLMs، ونماذج ML التقليدية، مع التركيز على القابلية للملاحظة والتقييم والنشر.

الأفلام والفيديو والإعلامVideo editing
sumOtotaO
جديد

SUM هي أداة مفتوحة المصدر للتحقق من تحويلات النصوص بالذكاء الاصطناعي باستخدام إيصالات تشفيرية. تتحقق مما تغيّر، وما تم الحفاظ عليه، وما فُقد عند إعادة كتابة النص بواسطة الذكاء الاصطناعي، مع توقيعات Ed25519 عبر بيئات التشغيل والتحقق دون اتصال.

الذكاء الاصطناعيأدوات التطويرAI assistants
garakNVIDIA
جديد

garak هو ماسح ضوئي مفتوح المصدر لثغرات نماذج اللغة الكبيرة من NVIDIA يفحص نماذج الذكاء الاصطناعي التوليدي بحثاً عن الهلوسة وتسريب البيانات وحقن الأوامر والسمية والهروب من القيود وغيرها من نقاط الضعف، على غرار nmap أو Metasploit لكن لنماذج اللغة الكبيرة.

الذكاء الاصطناعيأدوات التطويرTraining & evaluation
ifixaiifixai-ai
جديد

iFixAi هو أداة تدقيق مستقلة لوكلاء الذكاء الاصطناعي تقيّم مدى التزام الوكيل بمؤشرات الأداء الرئيسية هيكل تنظيمي من خلال نظام نقاط.

الذكاء الاصطناعيTraining & evaluation
deepevalconfident-ai
جديد

DeepEval هو إطار عمل مفتوح المصدر لتقييم نماذج اللغات الكبيرة (LLM)، مصمم لاختبار تطبيقات الذكاء الاصطناعي، بما في ذلك خطوط أنابيب RAG والوكلاء وروبوتات الدردشة، مما يتيح للمطورين إجراء اختبارات شاملة للجودة.

الذكاء الاصطناعيأدوات التطويرTraining & evaluation