Tesseract ایک اوپن سورس OCR انجن ہے جو تصاویر میں متن کی شناخت کے لیے ایک کمانڈ لائن ٹول اور لائبریری فراہم کرتا ہے، جو 100 سے زائد زبانوں کو سپورٹ کرتا ہے۔
اوپن سورس۔ نئے امکانات۔
معیاری اوپن سورس پروجیکٹس دریافت کریں، گمنام طور پر پروجیکٹس جمع کریں، اور اپنے پروجیکٹ کا دعویٰ کرکے اسے ایڈٹ کریں۔
تجسس کے ساتھ اوپن سورس کی دنیا دریافت کریں۔
THE FIRST COLLECTIONپیج لیجر ایک پائتھون CLI لائبریری ہے جو قابل تصدیق، پیج سطح کی OCR اور دستاویز نکالنے کے کام کے لیے استعمال ہوتی ہے۔ یہ ہر نکالی گئی پیج کے لیے ماخذ کی تصدیق، معیار کے اشارے اور بجٹ کی ریکارڈ رکھتی ہے، جاری رہنے والے رنز، جائزہ قطاروں اور انسانی مداخلت کے ساتھ دوبارہ چلانے کی سہولت دیتی ہے۔
Tesseract.js ایک JavaScript OCR لائبریری ہے جو 100 سے زائد زبانوں میں تصاویر سے متن نکالتی ہے۔ یہ WebAssembly کے ذریعے براؤزرز اور Node.js دونوں میں چلتی ہے، بغیر Tesseract انجن کے شناختی ماڈل کو تبدیل کیے۔
OCRmyPDF ایک کمانڈ لائن ٹول ہے جو سکین شدہ پی ڈی ایف فائلوں میں تلاش کرنے کے قابل OCR ٹیکسٹ لیئر شامل کرتا ہے۔ یہ Tesseract کا استعمال کرتا ہے، ڈیسکewing اور گھماؤ کی اصلاح کی حمایت کرتا ہے، اور Linux، macOS، Windows اور FreeBSD پر چلتا ہے۔