Tesseract হলো একটি ওপেন-সোর্স OCR ইঞ্জিন যা ১০০টিরও বেশি ভাষায় ছবির লেখা শনাক্ত করার জন্য একটি কমান্ড-লাইন টুল এবং লাইব্রেরি প্রদান করে।
ওপেন সোর্স। নতুন সম্ভাবনা।
মানসম্মত ওপেন-সোর্স প্রজেক্ট আবিষ্কার করুন, বেনামে প্রজেক্ট জমা দিন এবং নিজের প্রজেক্ট দাবি করে সম্পাদনা করুন।
কৌতূহল নিয়ে ওপেন সোর্স আবিষ্কার করুন।
THE FIRST COLLECTIONPageLedger একটি ওপেন-সোর্স পাইথন CLI লাইব্রেরি যা OCR এবং নথি এক্সট্রাকশনের জন্য পৃষ্ঠা-স্তরের অডিটেবল ট্র্যাকিং প্রদান করে। এটি প্রতিটি পৃষ্ঠার জন্য প্রমাণিক, গুণমান সংকেত এবং বাজেট ট্র্যাক করে, রিসামেবল রান এবং মূল্যায়ন কিউ সাপোর্ট করে।
Tesseract.js একটি জাভাস্ক্রিপ্ট OCR লাইব্রেরি যা ১০০ এরও বেশি ভাষায় ছবি থেকে টেক্সট বের করে। এটি WebAssembly এর মাধ্যমে ব্রাউজারে এবং Node.js-এ চলে।
OCRmyPDF একটি কমান্ড-লাইন টুল যা স্ক্যান করা PDF ফাইলে অনুসন্ধানযোগ্য OCR টেক্সট স্তর যোগ করে, যা যাচাইকৃত PDF/A আউটপুট তৈরি করে। এটি ১০০-এর বেশি ভাষায় Tesseract ব্যবহার করে, ডেস্কিউয়িং এবং রোটেশন সংশোধন সমর্থন করে, এবং Linux, macOS, Windows ও FreeBSD-এ চলে।