Hugging Face Transformers est un cadre de définition de modèles pour l'apprentissage automatique couvrant le texte, la vision, l'audio et les tâches multimodales. Il fournit une API unifiée pour l'inférence et l'entraînement avec plus d'un million de points de contrôle pré-entraînés.
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONUn catalogue maintenu par la communauté de ressources NLP en bengali — 712 articles, 63 jeux de données, 20 modèles et 9 outils sur 13 tâches — construit comme un site statique Astro avec une vérification stricte des données et des filtres partageables.
TextBlob est une bibliothèque Python pour le traitement du langage naturel, offrant une API simple pour l'analyse de sentiments, l'étiquetage grammatical, l'extraction de syntagmes nominaux, la classification, la tokenisation, et plus, basée sur NLTK et pattern.
Made With ML est un cours et un codebase open-source enseignant la conception, le développement, le déploiement et l'itération d'applications ML de production, couvrant MLOps, tests, serving, CI/CD et apprentissage continu.
Dépôt de code officiel pour « Build a Large Language Model (From Scratch) » : implémentation PyTorch pas à pas de modèles de type GPT, couvrant pré-entraînement et affinage avec notebooks et exercices.
DocsGPT est une plateforme d'IA open-source pour créer des agents et assistants intelligents, proposant l'analyse de documents, le support multi-modèles et des capacités de recherche d'entreprise.
Une collection d'expériences de traitement du langage naturel (NLP) axées sur les vecteurs de mots, les transformers et les algorithmes NLP fondamentaux.
Resume Matcher est un outil open-source basé sur l'IA qui personnalise CV et lettres de motivation pour chaque candidature, compatible avec plus de 100 LLM, en local ou dans le cloud, avec modèles et support multilingue.
NLTK est une suite complète de modules Python, de jeux de données et de tutoriels open-source conçus pour soutenir la recherche et le développement en traitement du langage naturel.
Une collection d'exemples de code et de tutoriels en apprentissage automatique et en apprentissage profond accompagnant des cours en ligne. Couvre des sujets allant de la régression linéaire à l'apprentissage par renforcement, le NLP, la vision par ordinateur et l'IA générative.
HanLP est une boîte à outils multilingue de traitement du langage naturel pour la production, basée sur PyTorch et TensorFlow 2.x. Elle prend en charge segmentation, étiquetage, entités nommées, syntaxe, sémantique, et offre des API RESTful et locale.