عن المشروع

GraphRAG هو خط أنابيب بيانات ومجموعة أدوات تحويل مصممة لاستخراج بيانات منظمة ذات معنى من نص غير منظم باستخدام نماذج لغوية كبيرة. فكرته الأساسية هي بناء بنى ذاكرة على شكل رسوم بيانية معرفية يمكن استخدامها لتكوين سياق موجّه للإجابة عن الأسئلة، مما يعزز قدرة LLM على الاستدلال بشأن بيانات خاصة أو سردية. المستودع من Microsoft Research ويوصف صراحةً بأنه مشروع بحثي، وليس عرضًا مدعومًا رسميًا من Microsoft. منذ إصداره الأول في يوليو 2024، دخل المشروع إلى حد كبير في وضع الصيانة: فهو لا يقبل طلبات سحب جديدة ولا ينفذ ميزات جديدة، لكن المشرفين سيقومون بإصلاحات الأخطاء وتحديثات التبعيات حسب الاقتضاء، لا سيما لمعالجة CVEs. يوصى بالبدء عبر البداية السريعة من سطر الأوامر في الوثائق الرسمية. يحذر README بشدة من أن فهرسة GraphRAG يمكن أن تكون عملية مكلفة، ويحث المستخدمين على قراءة كل الوثائق، وفهم العمليات والتكاليف المتضمنة، والبدء بنطاق صغير. كما يوصي بضبط المطالبات (prompt tuning) للحصول على أفضل النتائج عند استخدام GraphRAG مع بياناتك الخاصة، لأن الاستخدام الجاهز قد لا يحقق نتائج مثالية. توجد إرشادات الإصدارات في مستند التغييرات الكاسرة. يُنصح المستخدمون بتشغيل graphrag init --root [path] --force بين ترقيات الإصدارات الثانوية لضمان أحدث تنسيق للإعدادات، وب تشغيل دفتر الملاحظات المخصص للترحيل بين ترقيات الإصدارات الرئيسية لتجنب إعادة فهرسة مجموعات البيانات السابقة. قد يؤدي هذا إلى الكتابة فوق الإعدادات والمطالبات، لذا يُوصى بعمل نسخ احتياطية. يتضمن المشروع الأسئلة الشائعة حول الذكاء الاصطناعي المسؤول، وتغطي ما هو GraphRAG، وما يمكنه فعله، والاستخدامات المقصودة، ومقاييس التقييم، والقيود، وإعدادات التشغيل للاستخدام المسؤول. كما يتبع سياسات Microsoft للعلامات التجارية والخصوصية. بشكل عام، يقدم GraphRAG نهجًا معياريًا لدمج الرسوم البيانية المعرفية مع التوليد المعزز بالاسترجاع، لكن على المستخدمين المحتملين إدراك وضعه البحثي، وقيود وضع الصيانة، وتكاليف الفهرسة التي قد تكون كبيرة قبل تبنيه.