프로젝트 소개

smartscan-lib는 온디바이스 AI 애플리케이션을 위한 핵심 ML 및 데이터 인프라를 제공하는 Python 라이브러리입니다. README에 따르면 이 라이브러리는 데스크탑 앱에서 사용하는 SmartScan Server를 구동합니다. 라이브러리는 양자화된 임베딩 제공자를 노출합니다. 이미지용으로 CLIP ViT-B-32, DINOv2 Small, 얼굴 인식을 위한 Inception ResNet V2를 지원합니다. 텍스트용으로 CLIP ViT-B-32, all-MiniLM-L6-v2, all-distilroberta-v1을 제공합니다. ModelManager를 통해 이미지 및 텍스트 임베더에 접근할 수 있으며, 단일 및 배치 임베딩 모두 지원합니다. 인덱서는 BatchProcessor 추상화에 기반하여 구축되었으며 ImageIndexer, VideoIndexer, DocIndexer가 포함됩니다. URL 또는 로컬 경수를 받아 구성된 임베더를 사용하며, 진행 상황 및 배치 콜백을 위한 선택적 ProcessorListener를 받을 수 있습니다. 추가 구성 요소로는 유사성에 따른 임베딩 그룹화를 위한 선행 존재할 경우 임베딩 및 클러스터와 함께 자동 병합을 지원할 수 있는 IncrementalClusterer가 있으며, few_shot_classify 또는 FewShotClassifier를 통한 few-shot 분류 기능이 포함되어 있습니다. 이는 사전 레이블이 지정된 클러스터 중심에 대해 임베딩을 비교하며 배치 지원을 합니다. 설치에는 Python 3.10+가 필요하며 Git 저장소에서 pip를 사용하여 설치할 수 있습니다. README는 배포 세부사항보다는 라이브러리 사용 예시에 초점을 맞추고 있습니다.