इस प्रोजेक्ट के बारे में

Tesseract एक व्यापक Optical Character Recognition (OCR) पैकेज है जिसमें `libtesseract` लाइब्रेरी और एक `tesseract` कमांड-लाइन प्रोग्राम शामिल है। यह Unicode (UTF-8) का समर्थन करता है और 100 से अधिक भाषाओं को सीधे पहचान सकता है, साथ ही इसे अतिरिक्त भाषाओं के लिए प्रशिक्षित करने की क्षमता भी है। मुख्य तकनीकी क्षमताओं में शामिल हैं: - OCR इंजन: इसमें एक आधुनिक न्यूरल नेटवर्क (LSTM) आधारित इंजन है जो लाइन रिकग्निशन पर केंद्रित है, जबकि यह लीगेसी कैरेक्टर-पैटर्न रिकग्निशन इंजन (Tesseract 3) के साथ अनुकूलता बनाए रखता है। - इनपुट सपोर्ट: Leptonica लाइब्रेरी के माध्यम से PNG, JPEG और TIFF सहित विभिन्न इमेज फॉर्मेट के साथ संगत है। - आउटपुट फॉर्मेट: यह प्लेन टेक्स्ट, hOCR (HTML), PDF (केवल अदृश्य-टेक्स्ट सहित), TSV, ALTO और PAGE सहित कई आउटपुट प्रकारों का समर्थन करता है। - डेवलपर इंटीग्रेशन: कस्टम एप्लिकेशन बनाने के लिए C और C++ APIs प्रदान करता है, जिसमें अन्य प्रोग्रामिंग भाषाओं के लिए विभिन्न रैपर्स उपलब्ध हैं। Tesseract एक non-GUI टूल है; जिन उपयोगकर्ताओं को ग्राफिकल इंटरफेस की आवश्यकता है, उन्हें थर्ड-पार्टी एप्लिकेशन का उपयोग करना होगा। यह Apache License 2.0 के तहत लाइसेंस प्राप्त है।