Об этом проекте
PolyOCR Service представляет собой независимый сервис, управляемый сообществом и предназначенный для удобного API-развертывания PaddleOCR 3.x. Его основные возможности включают:
- **Многоязычный OCR**: поддержка 78 языков (включая китайский, японский, корейский, латиницу, кириллицу, арабский и др.); выбор языка возможен через код языка, английское или китайское название.
- **Интеграция перевода**: предоставляет опциональный интерфейс перевода с поддержкой сервисов, совместимых с OpenAI, с ограничениями на количество входных записей и символов.
- **PaddleOCR-VL**: предоставляет отдельный сервис визуально-языковой модели, требующий индивидуальный API Key и принимающий только загрузку файлов.
- **Отказоустойчивость и проверка**: проверка языка на границах запроса, предварительная проверка количества байтов изображения, количества пикселей и порога уверенности; синхронный вывод выполняется через пул потоков и ограничивается семафором для управления параллелизмом.
- **Бенчмаркинг**: проект включает встроенные инструменты для детального тестирования точности, устойчивости (к размытию, сжатию, повороту и другим сценариям деградации), а также тесты на основе реальных фотографий (набор данных CORD-v2).
Сервис предоставляет веб-страницу и REST API, поддерживает развертывание через Docker и распространяется под лицензией Apache License 2.0.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.