Об этом проекте

PolyOCR Service представляет собой независимый сервис, управляемый сообществом и предназначенный для удобного API-развертывания PaddleOCR 3.x. Его основные возможности включают: - **Многоязычный OCR**: поддержка 78 языков (включая китайский, японский, корейский, латиницу, кириллицу, арабский и др.); выбор языка возможен через код языка, английское или китайское название. - **Интеграция перевода**: предоставляет опциональный интерфейс перевода с поддержкой сервисов, совместимых с OpenAI, с ограничениями на количество входных записей и символов. - **PaddleOCR-VL**: предоставляет отдельный сервис визуально-языковой модели, требующий индивидуальный API Key и принимающий только загрузку файлов. - **Отказоустойчивость и проверка**: проверка языка на границах запроса, предварительная проверка количества байтов изображения, количества пикселей и порога уверенности; синхронный вывод выполняется через пул потоков и ограничивается семафором для управления параллелизмом. - **Бенчмаркинг**: проект включает встроенные инструменты для детального тестирования точности, устойчивости (к размытию, сжатию, повороту и другим сценариям деградации), а также тесты на основе реальных фотографий (набор данных CORD-v2). Сервис предоставляет веб-страницу и REST API, поддерживает развертывание через Docker и распространяется под лицензией Apache License 2.0.