منصوبے کے بارے میں

Tesseract ایک جامع Optical Character Recognition (OCR) پیکیج ہے جس میں `libtesseract` لائبریری اور ایک `tesseract` کمانڈ لائن پروگرام شامل ہے۔ یہ Unicode (UTF-8) کو سپورٹ کرتا ہے اور 100 سے زائد زبانوں کو فوری طور پر پہچان سکتا ہے، جبکہ اسے اضافی زبانوں کے لیے تربیت دینے کی صلاحیت بھی موجود ہے۔ اہم تکنیکی صلاحیتوں میں شامل ہیں: - OCR Engines: اس میں ایک جدید نیورل نیٹ ورک (LSTM) پر مبنی انجن ہے جو لائن کی شناخت پر توجہ مرکوز کرتا ہے، جبکہ پرانے کریکٹر پیٹرن ریکگنیشن انجن (Tesseract 3) کے ساتھ مطابقت بھی برقرار رکھتا ہے۔ - Input Support: Leptonica لائبریری کے ذریعے PNG، JPEG، اور TIFF سمیت مختلف امیج فارمیٹس کے ساتھ مطابقت رکھتا ہے۔ - Output Formats: یہ متعدد آؤٹ پٹ اقسام کو سپورٹ کرتا ہے، بشمول سادہ متن، hOCR (HTML)، PDF (بشمول صرف غیر مرئی متن)، TSV، ALTO، اور PAGE۔ - Developer Integration: کسٹم ایپلی کیشنز بنانے کے لیے C اور C++ APIs فراہم کرتا ہے، اور دیگر پروگرامنگ زبانوں کے لیے مختلف ریپرز (wrappers) دستیاب ہیں۔ Tesseract ایک non-GUI ٹول ہے؛ گرافیکل انٹرفیس کے خواہشمند صارفین کو تھرڈ پارٹی ایپلی کیشنز استعمال کرنی ہوں گی۔ یہ Apache License 2.0 کے تحت لائسنس شدہ ہے۔