À propos du projet
smartscan-lib est une bibliothèque Python qui fournit l'infrastructure ML et données de base pour les applications d'IA sur appareil. Selon le README, elle alimente le SmartScan Server utilisé par l'application Desktop.
La bibliothèque propose des fournisseurs d'embeddings quantifiés. Pour les images : CLIP ViT-B-32, DINOv2 Small et Inception ResNet V2 pour la reconnaissance faciale. Pour le texte : CLIP ViT-B-32, all-MiniLM-L6-v2 et all-distilroberta-v1. Un ModelManager donne accès aux embedders d'images et de texte, qui prennent en charge l'embedding unitaire et par lots.
Les indexeurs sont construits sur l'abstraction BatchProcessor et incluent ImageIndexer, VideoIndexer et DocIndexer. Ils acceptent des URL ou des chemins locaux, utilisent l'embedder configuré et peuvent recevoir un ProcessorListener facultatif pour les retours sur la progression et les lots.
Des composants supplémentaires incluent IncrementalClusterer pour regrouper les embeddings par similarité avec des seuils adaptatifs, des assignations et clusters existants, et une fusion automatique facultative ; ainsi que la classification few-shot via few_shot_classify ou FewShotClassifier, qui compare les embeddings aux centroïdes de clusters pré-étiquetés avec prise en charge du traitement par lots.
L'installation nécessite Python 3.10 ou version ultérieure et peut être effectuée depuis le dépôt Git avec pip. Le README se concentre sur des exemples d'utilisation de la bibliothèque plutôt que sur les détails de déploiement.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.