这个项目能做什么

PolyOCR Service 是一个社区驱动的独立服务,旨在为 PaddleOCR 3.x 提供便捷的 API 部署。其核心能力包括: - **多语言 OCR**:支持 78 种语言(涵盖汉字、日文、韩文、拉丁、西里尔、阿拉伯等),支持通过语种码、英文名或中文名指定语言。 - **翻译集成**:提供可选的翻译接口,支持 OpenAI 兼容的翻译服务,并对输入条目数和字符数进行限制。 - **PaddleOCR-VL**:提供独立的视觉语言模型服务,要求独立 API Key 且仅接受文件上传。 - **鲁棒性与校验**:在请求边界完成语言校验,对图片字节数、像素数和置信度阈值进行预校验;同步推理通过线程池执行并由信号量限制并发。 - **基准测试**:项目内置了详细的准确率、鲁棒性(针对模糊、压缩、旋转等退化场景)以及基于真实照片(CORD-v2 数据集)的基准测试工具。 该服务提供 Web 页面和 REST API,支持 Docker 部署,并采用 Apache License 2.0 许可证。