PaddlePaddle est une plateforme d'apprentissage profond de qualité industrielle offrant un framework complet pour le machine learning, incluant des bibliothèques de modèles et des kits de développement.
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONUne boîte à outils complète pour la vision par ordinateur offrant des blocs de construction agnostiques vis-à-vis des modèles pour le chargement des données, la visualisation et la gestion des ensembles de données.
Gradio est une bibliothèque Python open-source permettant de créer et de partager rapidement des applications web pour des modèles de machine learning, des API ou toute fonction Python, sans expérience en développement web.
Magika est l'outil de détection de type de contenu de fichiers propulsé par l'IA de Google. Il utilise un petit modèle d'apprentissage profond pour identifier plus de 200 types de fichiers en quelques millisecondes sur un seul CPU, avec une précision d'environ 99 %. Disponible en tant qu'interface en ligne de commande Rust, ainsi que des liaisons Python, JavaScript et Go.
Pyro est une bibliothèque de programmation probabiliste profonde flexible et évolutive, construite sur PyTorch, prenant en charge des modèles probabilistes universels et l'inférence automatisée.
Curriculum gratuit et open source d'ingénierie IA à partir des premiers principes : 523 leçons en 20 phases (~342 heures), couvrant des mathématiques à la production en Python, TypeScript, Rust et Julia. Chaque leçon produit un prompt, skill, agent ou serveur MCP réutilisable ; inclut un tuteur IA installable et une préparation à la certification Claude.
Sonnet est une bibliothèque de réseaux neuronaux open-source de DeepMind, construite sur TensorFlow 2. Elle offre des abstractions modulaires via snt.Module pour la recherche en apprentissage automatique, facilitant le développement de modèles personnalisés, leur sérialisation et l'entraînement distribué.
Tesseract.js est une bibliothèque OCR JavaScript extrayant du texte d'images dans plus de 100 langues. Elle fonctionne dans les navigateurs via WebAssembly et sur Node.js, sans modifier le modèle de reconnaissance.
dlib est un kit complet en C++ conçu pour créer des logiciels complexes de résolution de problèmes réels grâce au machine learning et à l'analyse de données, sous licence Boost.
EasyOCR est une bibliothèque de reconnaissance optique de caractères prête à l'emploi, prenant en charge plus de 80 langues et les principaux systèmes d'écriture. Elle propose une API Python simple et une interface en ligne de commande, avec des modèles de détection et de reconnaissance basés sur PyTorch, ainsi que des options d'entraînement personnalisé.
Une collection d'exemples de code et de tutoriels en apprentissage automatique et en apprentissage profond accompagnant des cours en ligne. Couvre des sujets allant de la régression linéaire à l'apprentissage par renforcement, le NLP, la vision par ordinateur et l'IA générative.
Label Studio est un outil open-source d'annotation de données multi-types prenant en charge l'audio, le texte, les images, la vidéo et les séries temporelles, avec une interface utilisateur simple et l'exportation vers divers formats de modèles.
X-AnyLabeling est une application de bureau multiplateforme et légère pour l'annotation de données assistée par IA. Elle prend en charge le texte, les images, les vidéos et les données multimodales, avec de nombreux modèles intégrés, des outils variés et l'import/export multi-formats.
Un guide complet pour les entretiens techniques IA/ML dans les grandes entreprises technologiques, couvrant le codage, les fondamentaux du ML, la conception de systèmes et la préparation comportementale, avec un tuteur IA optionnel basé sur MCP.
Ce dépôt regroupe des ressources open source sur les agents IA : livres, cours, dépôts de code, listes de papiers, règles pour agents, expériences d'écriture, écosystème Harness et frameworks majeurs. Les étoiles GitHub sont mises à jour quotidiennement et triées par popularité, avec un parcours de lecture recommandé.
ModelScope est une bibliothèque Python open-source implémentant le concept de « Model-as-a-Service », offrant des interfaces unifiées pipeline, Trainer et MsDataset pour l'inférence, le fine-tuning et l'évaluation de modèles CV, NLP, audio, multi-modaux et scientifiques, avec intégration de hubs de modèles et de jeux de données.
einops est une bibliothèque Python open-source de manipulation de tenseurs, utilisant une notation inspirée d'Einstein pour un code lisible et fiable sur PyTorch, JAX, TensorFlow, NumPy et plus.
Hugging Face Transformers est un cadre de définition de modèles pour l'apprentissage automatique couvrant le texte, la vision, l'audio et les tâches multimodales. Il fournit une API unifiée pour l'inférence et l'entraînement avec plus d'un million de points de contrôle pré-entraînés.
AutoKeras est une bibliothèque AutoML open source basée sur Keras qui automatise la recherche de modèles d'apprentissage profond pour les tâches d'image, de texte et de données structurées.
Apache TVM est un framework de compilation d'apprentissage automatique ouvert, conçu pour un déploiement universel et des pipelines de compilation personnalisables.