इस प्रोजेक्ट के बारे में
PolyOCR Service एक समुदाय-संचालित स्वतंत्र सेवा है, जिसे PaddleOCR 3.x के लिए सुविधाजनक API परिनियोजन (deployment) प्रदान करने के लिए डिज़ाइन किया गया है। इसकी मुख्य क्षमताओं में शामिल हैं:
- **बहुभाषी OCR**: 78 भाषाओं का समर्थन करता है (जिसमें चीनी, जापानी, कोरियाई, लैटिन, सिरिलिक, अरबी आदि शामिल हैं), और भाषा कोड, अंग्रेजी नाम या चीनी नाम के माध्यम से भाषा निर्दिष्ट करने का समर्थन करता है।
- **अनुवाद एकीकरण**: वैकल्पिक अनुवाद इंटरफेस प्रदान करता है, जो OpenAI संगत अनुवाद सेवाओं का समर्थन करता है, और इनपुट प्रविष्टियों की संख्या और वर्णों की संख्या पर सीमाएं लगाता है।
- **PaddleOCR-VL**: एक स्वतंत्र विज़न-लैंग्वेज मॉडल सेवा प्रदान करता है, जिसके लिए एक स्वतंत्र API Key की आवश्यकता होती है और यह केवल फ़ाइल अपलोड स्वीकार करता है।
- **रोबस्टनेस और सत्यापन**: अनुरोध सीमाओं पर भाषा सत्यापन पूरा करता है, और इमेज बाइट्स, पिक्सेल संख्या और कॉन्फिडेंस थ्रेशोल्ड का पूर्व-सत्यापन करता है; सिंक्रोनस इन्फरेंस थ्रेड पूल के माध्यम से निष्पादित किया जाता है और सेमाफोर द्वारा समवर्तीता (concurrency) को सीमित किया जाता है।
- **बेंचमार्किंग**: प्रोजेक्ट में सटीकता, रोबस्टनेस (धुंधलेपन, संपीड़न, रोटेशन जैसे डिग्रेडेशन परिदृश्यों के लिए) और वास्तविक तस्वीरों (CORD-v2 डेटासेट) पर आधारित विस्तृत बेंचमार्किंग टूल अंतर्निहित हैं।
यह सेवा वेब पेज और REST API प्रदान करती है, Docker परिनियोजन का समर्थन करती है, और Apache License 2.0 लाइसेंस का उपयोग करती है।
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.