Tesseract.js é uma biblioteca OCR em JavaScript que extrai texto de imagens em mais de 100 idiomas. Executa-se em navegadores via WebAssembly e no Node.js, sem modificar o modelo de reconhecimento.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONEasyOCR é uma biblioteca de reconhecimento óptico de caracteres pronta para uso, com suporte a mais de 80 idiomas e principais sistemas de escrita. Oferece API Python simples e CLI, com modelos de detecção e reconhecimento baseados em PyTorch, além de opções de treinamento personalizado.
einops é uma biblioteca flexível de operações de tensor que usa notação inspirada em Einstein para código legível e confiável em PyTorch, JAX, TensorFlow, NumPy e outros.
Hugging Face Transformers é um framework de definição de modelos para aprendizado de máquina em tarefas de texto, visão, áudio e multimodais. Oferece uma API unificada para inferência e treinamento com mais de 1 milhão de checkpoints pré-treinados.
AutoKeras é uma biblioteca AutoML de código aberto construída sobre o Keras que automatiza a busca de modelos de aprendizado profundo para tarefas de imagem, texto e dados estruturados.
O MediaPipe é um framework multiplataforma de código aberto do Google que oferece soluções de aprendizado de máquina no dispositivo para mídia ao vivo e streaming, abrangendo visão, texto e áudio em Android, iOS, web, desktop e dispositivos de borda. Sua documentação principal está em developers.google.com/mediapipe, e inclui componentes como Tasks, Model Maker e Studio.