Une boîte à outils complète pour la vision par ordinateur offrant des blocs de construction agnostiques vis-à-vis des modèles pour le chargement des données, la visualisation et la gestion des ensembles de données.
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONUne collection croissante de 61 tutoriels de vision par ordinateur couvrant des modèles de pointe comme YOLO11, SAM 3, RF-DETR et Qwen3-VL pour la détection d'objets, la segmentation, l'OCR, et plus encore.
LocalAI est un moteur d'inférence IA auto-hébergé, open-source, qui exécute localement des modèles LLM, vision, voix, image et vidéo sur tout type de matériel, y compris CPU uniquement. Il offre des API compatibles OpenAI, Anthropic et ElevenLabs, des backends modulaires à la demande, une authentification multi-utilisateur et des agents intégrés avec RAG et MCP.
X-AnyLabeling est une application de bureau multiplateforme et légère pour l'annotation de données assistée par IA. Elle prend en charge le texte, les images, les vidéos et les données multimodales, avec de nombreux modèles intégrés, des outils variés et l'import/export multi-formats.
Frigate is a local NVR for IP cameras with AI object detection, built for Home Assistant. It uses OpenCV/TensorFlow, motion-triggered detection, MQTT, object-based retention, 24/7 recording, RTSP restreaming, and WebRTC/MSE live view.
Ultralytics propose une suite de modèles YOLO de pointe pour les tâches de vision par ordinateur, notamment la détection d'objets, la segmentation et la classification.
RF-DETR est une architecture de transformeur en temps réel de Roboflow pour la détection d'objets, la segmentation d'instances et la détection de points clés, basée sur un backbone DINOv2 et conçue pour le réglage fin.
jetson-inference est une bibliothèque de vision profonde en C++ et Python pour NVIDIA Jetson. Elle utilise TensorRT pour l'inférence sur appareil et PyTorch pour l'entraînement, avec des exemples, des modèles pré-entraînés et des tutoriels pour la classification, la détection, la segmentation, la pose, l'action, la profondeur et le streaming de caméra.
YOLOv5 est un framework open-source de vision par ordinateur basé sur PyTorch, dédié à la détection d'objets, la segmentation d'instances et la classification. Il propose des modèles pré-entraînés, l'inférence depuis diverses sources et l'export vers ONNX, TensorRT ou CoreML.
FiftyOne est un outil open-source pour créer des jeux de données de haute qualité et affiner des modèles d'vision par ordinateur, offrant une interface visuelle pour l'exploration, l'étiquetage, l'évaluation et la purification des données visuelles.