इस प्रोजेक्ट के बारे में
EasyOCR एक ओपन-सोर्स ऑप्टिकल कैरेक्टर रिकग्निशन (OCR) लाइब्रेरी है जिसे बॉक्स से बाहर उपयोग के लिए तैयार रहने के डिज़ाइन किया गया है। इसके README के अनुसार, यह 80 से अधिक भाषाओं और सभी लोकप्रिय लेखन लिपियों का समर्थन करता है, जिनमें लैटिन, चीनी, अरबी, देवनागरी और सिरिलिक शामिल हैं।
स्थापना pip के माध्यम से की जाती है (`pip install easyocr`), और एक Dockerfile भी प्रदान की गई है। Windows पर, उपयोगकर्ताओं को सलाह दी जाती है कि वे पहले PyTorch और torchvision स्थापित करें। चयनित भाषाओं के मॉडल वेट स्वचालित रूप से डाउनलोड होते हैं या `~/.EasyOCR/model` फ़ोल्डर में मैन्युअल रूप से रखे जा सकते हैं।
मूल Python उपयोग एक बार reader लोड करता है और फिर छवियों को प्रोसेस करता है:
import easyocr
reader = easyocr.Reader(['ch_sim','en'])
result = reader.readtext('chinese.jpg')
आउटपुट आइटमों की एक सूची है, जिनमें से प्रत्येक में बाउंडिंग बॉक्स, पहचाना गया टेक्स्ट और एक कॉन्फिडेंस स्कोर होता है। `detail=0` विकल्प केवल पहचाने गए स्ट्रिंग लौटाता है। इनपुट फ़ाइल पथ, OpenCV/numpy छवि ऑब्जेक्ट, छवि बाइट्स, या कच्ची छवि का URL हो सकते हैं। CPU-only मोड `gpu=False` के साथ उपलब्ध है। एक कमांड-लाइन इंटरफ़ेस भी शामिल है, उदाहरण के लिए `easyocr -l ch_sim en -f chinese.jpg --detail=1 --gpu=True`।
README नोट करता है कि एक साथ कई भाषाएँ पास की जा सकती हैं, हालाँकि सभी संयोजन संगत नहीं हैं; अंग्रेजी को हर भाषा के साथ संगत बताया गया है, और सामान्य वर्ण साझा करने वाली भाषाएँ आमतौर पर एक-दूसरे के साथ संगत होती हैं।
अंदर की बात करें तो, डिटेक्शन CRAFT एल्गोरिदम का उपयोग करता है और रिकग्निशन CRNN का उपयोग करता है जो फीचर एक्सट्रैक्शन (ResNet/VGG), सीक्वेंस लेबलिंग (LSTM) और CTC डिकोडिंग से बना है, सभी PyTorch के साथ निष्पादित होते हैं। परियोजना कई अपस्ट्रीम शोध रिपॉजिटरी और पेपरों को स्वीकार करती है। उपयोगकर्ता अपने स्वयं के रिकग्निशन और डिटेक्शन मॉडल को प्रशिक्षित या उपयोग कर सकते हैं, दोनों के लिए दस्तावेज़ लिंक किए गए हैं।
रोडमैप में नियोजित हस्तलिखित टेक्स्ट समर्थन और स्वैप करने योग्य डिटेक्शन और रिकग्निशन एल्गोरिदम की अनुमति देने के लिए पुनर्गठन का उल्लेख है। पुल रिक्वेस्ट, इश्यू रिपोर्ट और भाषा जोड़ने के माध्यम से योगदान का स्वागत है; नई भाषा जोड़ने के लिए कैरेक्टर और डिक्शनरी फ़ाइलों की आवश्यकता होती है। README यह भी नोट करता है कि छह महीने से पुराने इश्यू स्वचालित रूप से बंद हो सकते हैं, और Jaided AI द्वारा एंटरप्राइज़ समर्थन प्रदान किया जाता है।
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.