इस प्रोजेक्ट के बारे में
Tesseract एक व्यापक Optical Character Recognition (OCR) पैकेज है जिसमें `libtesseract` लाइब्रेरी और एक `tesseract` कमांड-लाइन प्रोग्राम शामिल है। यह Unicode (UTF-8) का समर्थन करता है और 100 से अधिक भाषाओं को सीधे पहचान सकता है, साथ ही इसे अतिरिक्त भाषाओं के लिए प्रशिक्षित करने की क्षमता भी है।
मुख्य तकनीकी क्षमताओं में शामिल हैं:
- OCR इंजन: इसमें एक आधुनिक न्यूरल नेटवर्क (LSTM) आधारित इंजन है जो लाइन रिकग्निशन पर केंद्रित है, जबकि यह लीगेसी कैरेक्टर-पैटर्न रिकग्निशन इंजन (Tesseract 3) के साथ अनुकूलता बनाए रखता है।
- इनपुट सपोर्ट: Leptonica लाइब्रेरी के माध्यम से PNG, JPEG और TIFF सहित विभिन्न इमेज फॉर्मेट के साथ संगत है।
- आउटपुट फॉर्मेट: यह प्लेन टेक्स्ट, hOCR (HTML), PDF (केवल अदृश्य-टेक्स्ट सहित), TSV, ALTO और PAGE सहित कई आउटपुट प्रकारों का समर्थन करता है।
- डेवलपर इंटीग्रेशन: कस्टम एप्लिकेशन बनाने के लिए C और C++ APIs प्रदान करता है, जिसमें अन्य प्रोग्रामिंग भाषाओं के लिए विभिन्न रैपर्स उपलब्ध हैं।
Tesseract एक non-GUI टूल है; जिन उपयोगकर्ताओं को ग्राफिकल इंटरफेस की आवश्यकता है, उन्हें थर्ड-पार्टी एप्लिकेशन का उपयोग करना होगा। यह Apache License 2.0 के तहत लाइसेंस प्राप्त है।
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.