عن المشروع

PolyOCR Service هي خدمة مستقلة يقودها المجتمع، تهدف إلى توفير نشر API سهل لـ PaddleOCR 3.x. وتشمل قدراتها الأساسية ما يلي: - **OCR متعدد اللغات**: يدعم 78 لغة (تشمل الصينية، واليابانية، والكورية، واللاتينية، والسيريلية، والعربية، وغيرها)، ويدعم تحديد اللغة عبر رمز اللغة، أو الاسم الإنجليزي، أو الاسم الصيني. - **تكامل الترجمة**: يوفر واجهات ترجمة اختيارية، ويدعم خدمات الترجمة المتوافقة مع OpenAI، مع فرض قيود على عدد المدخلات وعدد الأحرف. - **PaddleOCR-VL**: يوفر خدمة نموذج لغة بصرية مستقلة، تتطلب مفتاح API مستقل وتقبل فقط تحميل الملفات. - **المتانة والتحقق**: يتم إكمال التحقق من اللغة عند حدود الطلب، مع إجراء تحقق مسبق من عدد بايتات الصورة، وعدد البكسلات، وعتبة الثقة؛ ويتم تنفيذ الاستدلال المتزامن عبر مجموعة خيوط (thread pool) ويتم تقييد التزامن بواسطة semaphore. - **اختبارات القياس**: يتضمن المشروع أدوات تفصيلية لاختبار الدقة، والمتانة (بالنسبة لسيناريوهات التدهور مثل الضبابية، والضغط، والدوران)، واختبارات قياس تعتمد على صور حقيقية (مجموعة بيانات CORD-v2). توفر هذه الخدمة صفحة ويب و REST API، وتدعم النشر عبر Docker، وتعتمد ترخيص Apache License 2.0.