عن المشروع

LEANN هو قاعدة بيانات متجهات مبتكرة تتيح الجيل المعزز بالاسترجاع عالي الأداء (RAG) على الأجهزة الشخصية. يقلل بشكل كبير من الحمل التخزيني (حتى 97% مقارنة بقواعد بيانات المتجهات التقليدية) دون المساس بالدقة من خلال استخدام إعادة الحساب الانتقائي القائم على الرسوم البيانية مع الاقتطاع المحافظ على الدرجات العالية، والذي يحسب التضمينات عند الطلب بدلاً من تخزينها جميعاً. تشمل القدرات الرئيسية: - **تكامل البيانات واسع النطاق**: يدعم الفهرسة والبحث الدلالي عبر مصادر بيانات شخصية متنوعة، بما في ذلك النظام المحلي للملفات (.pdf, .txt, .md)، وبريد Apple، وسجل المتصفح، وسجلات المحادثات (WeChat, iMessage)، وذكريات وكلاء الذكاء الاصطناعي (ChatGPT, Claude). - **تكامل MCP**: متوافق بالكامل مع بروتوكول سياق النموذج (MCP)، مما يسمح له بالعمل كخدمة بحث دلالي لأدوات مثل Claude Code والتكامل مع البيانات المباشرة من منصات مثل Slack وTwitter. - **الاسترجاع متعدد الوسائط**: يتضمن تكامل ColQwen للاسترجاع البصري-اللغوي من ملفات PDF، مما يتيح البحث استناداً إلى كل من النص وتخطيطات/رسوم_DIAGرامات الصور. - **يركز على الخصوصية**: مصمم للعمل بالكامل على الأجهزة المحلية (macOS, Linux, Windows) بدون أي قياس عن بُعد وبدون حاجة لتخزين سحابي. - **واجهة خلفية مرنة**: يدعم واجهات خلفية متعددة للفهرسة (HNSW, DiskANN) ويتكامل مع مزودي نماذج لغوية كبيرة (LLM) وتضمين عبر واجهات برمجية متوافقة مع OpenAI، Ollama، HuggingFace، وAnthropic.