Sobre el proyecto

spaCy es una biblioteca para Procesamiento de Lenguaje Natural (NLP) avanzado en Python y Cython, diseñada para productos del mundo real. Proporciona pipelines preentrenados para más de 70 idiomas, velocidad de última generación y modelos de redes neuronales para tareas como etiquetado, análisis sintáctico, reconocimiento de entidades nombradas (NER) y clasificación de texto. Soporta aprendizaje multitarea con transformers preentrenados como BERT, un sistema de entrenamiento listo para producción y empaquetado e implementación sencillos de modelos. spaCy tiene licencia MIT e incluye visualizadores para sintaxis y NER, extensibilidad con componentes personalizados e integración con PyTorch y TensorFlow. La instalación está disponible a través de pip o conda, con opciones para descargar modelos entrenados y compilar desde el código fuente. El proyecto incluye documentación extensa, un curso en línea y soporte comunitario a través de GitHub Discussions y Stack Overflow.