প্রকল্প সম্পর্কে

Tesseract হলো একটি বিস্তৃত Optical Character Recognition (OCR) প্যাকেজ যা `libtesseract` লাইব্রেরি এবং একটি `tesseract` কমান্ড-লাইন প্রোগ্রাম নিয়ে গঠিত। এটি Unicode (UTF-8) সমর্থন করে এবং শুরু থেকেই ১০০টিরও বেশি ভাষা শনাক্ত করতে পারে, পাশাপাশি অতিরিক্ত ভাষার জন্য এটিকে প্রশিক্ষণ দেওয়ার ক্ষমতা রয়েছে। এর মূল কারিগরি সক্ষমতাগুলোর মধ্যে রয়েছে: - OCR ইঞ্জিন: এতে একটি আধুনিক নিউরাল নেটওয়ার্ক (LSTM) ভিত্তিক ইঞ্জিন রয়েছে যা লাইন রিকগনিশনের ওপর গুরুত্ব দেয়, পাশাপাশি এটি পুরনো ক্যারেক্টার-প্যাটার্ন রিকগনিশন ইঞ্জিনের (Tesseract 3) সাথে সামঞ্জস্য বজায় রাখে। - ইনপুট সাপোর্ট: Leptonica লাইব্রেরির মাধ্যমে PNG, JPEG এবং TIFF সহ বিভিন্ন ইমেজ ফরম্যাটের সাথে সামঞ্জস্যপূর্ণ। - আউটপুট ফরম্যাট: এটি প্লেইন টেক্সট, hOCR (HTML), PDF (অদৃশ্য-টেক্সট-অনলি সহ), TSV, ALTO এবং PAGE সহ একাধিক আউটপুট টাইপ সমর্থন করে। - ডেভেলপার ইন্টিগ্রেশন: কাস্টম অ্যাপ্লিকেশন তৈরির জন্য C এবং C++ API প্রদান করে, এবং অন্যান্য প্রোগ্রামিং ভাষার জন্য বিভিন্ন র‍্যাপার (wrappers) উপলব্ধ রয়েছে। Tesseract একটি নন-GUI টুল; যেসব ব্যবহারকারীর গ্রাফিক্যাল ইন্টারফেস প্রয়োজন, তাদের থার্ড-পার্টি অ্যাপ্লিকেশন ব্যবহার করতে হবে। এটি Apache License 2.0 এর অধীনে লাইসেন্সপ্রাপ্ত।