Sobre el proyecto

PolyOCR Service es un servicio independiente impulsado por la comunidad, diseñado para proporcionar un despliegue de API conveniente para PaddleOCR 3.x. Sus capacidades principales incluyen: - **OCR Multilingüe**: Soporta 78 idiomas (incluyendo caracteres chinos, japonés, coreano, latino, cirílico, árabe, entre otros), permitiendo especificar el idioma mediante códigos de idioma, nombres en inglés o nombres en chino. - **Integración de Traducción**: Ofrece interfaces de traducción opcionales, compatibles con servicios de traducción de OpenAI, con límites en el número de entradas y caracteres. - **PaddleOCR-VL**: Proporciona un servicio independiente de modelo de lenguaje visual, que requiere una API Key independiente y solo acepta la carga de archivos. - **Robustez y Validación**: Realiza la validación del idioma en los límites de la solicitud, con prevalidaciones de bytes de imagen, número de píxeles y umbrales de confianza; la inferencia síncrona se ejecuta a través de un grupo de hilos y la concurrencia es limitada por semáforos. - **Pruebas de Referencia (Benchmarking)**: El proyecto incluye herramientas detalladas de prueba de precisión, robustez (para escenarios degradados como desenfoque, compresión, rotación, etc.) y pruebas basadas en fotografías reales (conjunto de datos CORD-v2). Este servicio ofrece una página Web y una REST API, es compatible con el despliegue mediante Docker y utiliza la licencia Apache License 2.0.