ocrmypdfocrmypdf
НОВОЕOCRmyPDF — это инструмент командной строки, который добавляет поисковый OCR-слой в сканированные PDF-файлы, создавая валидный PDF/A. Использует Tesseract для распознавания более чем на 100 языках, поддерживает исправление наклона и поворота страниц, работает на Linux, macOS, Windows и FreeBSD.