Tesseract.js est une bibliothèque OCR JavaScript extrayant du texte d'images dans plus de 100 langues. Elle fonctionne dans les navigateurs via WebAssembly et sur Node.js, sans modifier le modèle de reconnaissance.
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONEasyOCR est une bibliothèque de reconnaissance optique de caractères prête à l'emploi, prenant en charge plus de 80 langues et les principaux systèmes d'écriture. Elle propose une API Python simple et une interface en ligne de commande, avec des modèles de détection et de reconnaissance basés sur PyTorch, ainsi que des options d'entraînement personnalisé.
einops est une bibliothèque Python open-source de manipulation de tenseurs, utilisant une notation inspirée d'Einstein pour un code lisible et fiable sur PyTorch, JAX, TensorFlow, NumPy et plus.
Hugging Face Transformers est un cadre de définition de modèles pour l'apprentissage automatique couvrant le texte, la vision, l'audio et les tâches multimodales. Il fournit une API unifiée pour l'inférence et l'entraînement avec plus d'un million de points de contrôle pré-entraînés.
AutoKeras est une bibliothèque AutoML open source basée sur Keras qui automatise la recherche de modèles d'apprentissage profond pour les tâches d'image, de texte et de données structurées.
MediaPipe est le framework multiplateforme de Google et sa suite de solutions d'apprentissage automatique sur appareil pour les médias en direct et en streaming, couvrant les tâches de vision, de texte et d'audio sur Android, iOS, web, bureau et périphériques de pointe.