Sobre el proyecto

Umi-OCR es un software de reconocimiento óptico de caracteres (OCR) sin conexión, gratuito y de código abierto, compatible con las plataformas Windows 7 x64 y Linux x64. El proyecto destaca por ser listo para usar tras descomprimirlo, sin necesidad de conexión a Internet, e incluye bibliotecas de reconocimiento sin conexión en varios idiomas. Funciones principales: - OCR en capturas de pantalla: activa la captura de pantalla mediante atajos de teclado y reconoce el texto de las imágenes; admite pegar imágenes para su reconocimiento, y el historial de reconocimiento se puede editar y copiar de forma múltiple. - Posprocesamiento de texto: ofrece varias soluciones de análisis de maquetación, reconociendo automáticamente diseños de varias columnas, saltos de línea por párrafos naturales, conservación de sangrías, etc., y admite maquetación horizontal y vertical (de derecha a izquierda). - OCR por lotes: admite la importación por lotes de formatos de imagen comunes como jpg, png, webp, bmp y tif. Los resultados se pueden exportar a txt, jsonl, md y csv (Excel) sin límite de cantidad, y permite el apagado o la suspensión automática tras completar las tareas. - Áreas a ignorar: permite dibujar recuadros rectangulares en la identificación por lotes para excluir texto no deseado, como marcas de agua o LOGO. - Reconocimiento de documentos: admite formatos como pdf, xps, epub, mobi, fb2 y cbz, permitiendo extraer texto de documentos escaneados o generar PDF de dos capas con opción de búsqueda, además de admitir áreas a ignorar para excluir encabezados y pies de página. - Códigos QR: permite leer y generar códigos QR/códigos de barras, cubriendo 19 protocolos, y admite múltiples códigos en una sola imagen y la configuración de niveles de corrección de errores. - Configuración global: permite cambiar el idioma de la interfaz, el tema, el tamaño de la fuente, cambiar los complementos de OCR y ajustar el renderizador para solucionar parpadeos en las capturas de pantalla o desalineaciones en la interfaz de usuario. Métodos de llamada: proporciona manuales para la línea de comandos e interfaz HTTP para facilitar la integración con programas externos. Los motores de OCR sin conexión admitidos incluyen PaddleOCR-json y RapidOCR-json, y el entorno de ejecución se basa en una versión personalizada de PyStand. El proyecto utiliza la plataforma Weblate para la colaboración en la traducción de localización de la interfaz y admite interfaces en varios idiomas.