프로젝트 소개

Umi-OCR은 무료 오픈소스 오프라인 문자 인식(OCR) 소프트웨어로, Windows 7 x64 및 Linux x64 플랫폼을 지원합니다. 이 프로젝트는 압축 해제 후 바로 사용 가능하고 인터넷 연결이 필요 없으며, 여러 언어의 오프라인 인식 라이브러리가 내장되어 있습니다. 주요 기능: - 스크린샷 OCR: 단축키로 스크린샷을 실행하고 이미지 속 텍스트를 인식합니다. 이미지 붙여넣기 인식을 지원하며, 인식 기록은 편집 및 다중 선택 복사가 가능합니다. - 텍스트 후처리: 다양한 레이아웃 해석 방식을 제공하여 다단 레이아웃 자동 인식, 자연 단락 줄바꿈, 들여쓰기 유지 등을 지원하며, 가로쓰기와 세로쓰기(오른쪽에서 왼쪽)를 지원합니다. - 일괄 OCR: jpg, png, webp, bmp, tif 등 일반적인 이미지 형식을 일괄 가져올 수 있으며, 결과는 txt, jsonl, md, csv(Excel)로 내보낼 수 있습니다. 수량 제한이 없고, 작업 완료 후 자동 종료 또는 대기 모드를 지원합니다. - 무시 영역: 일괄 인식 중 사각형 영역을 그려 워터마크, LOGO 등 방해 텍스트를 제외할 수 있습니다. - 문서 인식: pdf, xps, epub, mobi, fb2, cbz 등 형식을 지원하며, 스캔 문서에서 텍스트를 추출하거나 이중 레이어 검색 가능한 PDF를 출력할 수 있습니다. 또한 무시 영역을 사용하여 머리글/바닥글을 제외할 수 있습니다. - QR 코드: QR 코드/바코드 읽기 및 생성을 지원하며, 19가지 프로토콜을 포함합니다. 한 이미지의 여러 코드 인식과 오류 수정 레벨 설정을 지원합니다. - 전역 설정: 인터페이스 언어, 테마, 글꼴 크기를 전환할 수 있고, OCR 플러그인을 전환하며, 렌더러를 조정하여 스크린샷 깜빡임 또는 UI 정렬 문제를 해결할 수 있습니다. 호출 방식: 명령줄 매뉴얼과 HTTP 인터페이스 매뉴얼을 제공하여 외부 프로그램 통합이 용이합니다. 지원되는 오프라인 OCR 엔진에는 PaddleOCR-json과 RapidOCR-json이 있으며, 실행 환경은 맞춤형 PyStand 기반입니다. 프로젝트는 Weblate 플랫폼을 사용하여 인터페이스 현지화 번역 협업을 진행하며, 다국어 인터페이스를 지원합니다.