عن المشروع
smartscan-lib هي مكتبة بايثون توفر البنية التحتية الأساسية للذكاء الاصطناعي على الجهاز، حيث تقدم مقدمات للتضمين المكمم للصورة والنصوص. وفقًا لملف README، فإنها تدعم خادم SmartScan المستخدم من قبل تطبيق سطح المكتب.
تعرض المكتبة مقدمات لتضمينات مكممة. بالنسبة للصور: CLIP ViT-B-32، DINOv2 Small، و Inception ResNet V2 للتعرف على الوجوه. بالنسبة للنصوص: CLIP ViT-B-32، all-MiniLM-L6-v2، و all-distilroberta-v1. يوفر مدير النموذج (ModelManager) الوصول إلى مُضنين التضمين (embedders) للصور والنصوص، والتي تدعم التضمين الفردي والمجمّع.
تم بناء الفهاس (Indexers) على تجريد BatchProcessor وتشمل ImageIndexer و VideoIndexer و DocIndexer. تقبل هذه الفهاس عناوين URL أو مسارات محلية، وتستخدم المُضهن المُكوّن، ويمكنها قبول ProcessorListener اختياريًا لإشعارات التقدم والاستدعاءات المجمّعة.
تشمل المكونات الإضافية مُجمّع التجميع التدريجي (IncrementalClusterer) لمجموعة التضمينات حسب التشابه مع عتبات تكيفية، وتجمعات موجودة ومجمّعات، والتجميع التلقائي الاختياري؛ بالإضافة إلى التصنيف القليل النقطة عبر few_shot_classify أو FewShotClassifier، الذي يقارن بين التضمينات ومراكز التجمعات المُعلَّمة مسبقًا مع دعم الدفعات.
يتطلب التثبيت Python 3.10+ ويمكن القيام به من مستودع Git باستخدام pip. يركز ملف README على أمثلة استخدام المكتبة بدلاً من تفاصيل النشر.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.