عن المشروع

RAGFlow هو محرك RAG مفتوح المصدر مصمم لتحويل البيانات المعقدة وغير المهيكلة إلى أنظمة ذكاء اصطناعي جاهزة للإنتاج. يركز المحرك على الفهم العميق للمستندات ويوفر سير عمل مبسط للمؤسسات لدمج LLMs مع بياناتها الخاصة. تشمل القدرات الرئيسية ما يلي: - فهم عميق للمستندات لاستخراج المعرفة من البيانات غير المهيكلة ذات التنسيقات المعقدة. - تقسيم البيانات بناءً على قوالب (Template-based chunking) يتسم بالذكاء والقابلية للتفسير. - دعم مصادر بيانات متنوعة تشمل Word و Slides و Excel و TXT والصور والنسخ الممسوحة ضوئياً وصفحات الويب. - استشهادات موثقة لتقليل الهلوسة من خلال توفير مراجع قابلة للتتبع لقطع النصوص. - سير عمل مؤتمت لتنسيق RAG مع إمكانية تكوين LLMs ونماذج التضمين (embedding models) وإعادة التصنيف المدمجة (fused re-ranking). - التكامل مع سير عمل Agentic و MCP ومنفذ أكواد Python/JavaScript. - مزامنة البيانات من مصادر خارجية مثل Confluence و S3 و Notion و Discord و Google Drive. يمكن استضافة النظام ذاتياً عبر Docker وهو يدعم محركات مستندات متنوعة، بما في ذلك Elasticsearch (الافتراضي) و Infinity.