프로젝트 소개
Tesseract는 `libtesseract` 라이브러리와 `tesseract` 명령줄 프로그램으로 구성된 종합적인 광학 문자 인식(OCR) 패키지입니다. Unicode(UTF-8)를 지원하며, 기본적으로 100개 이상의 언어를 인식할 수 있고 추가 언어에 대한 학습도 가능합니다.
주요 기술적 역량은 다음과 같습니다:
- OCR 엔진: 라인 인식에 집중한 현대적인 신경망(LSTM) 기반 엔진을 특징으로 하며, 기존의 문자 패턴 인식 엔진(Tesseract 3)과의 호환성도 유지합니다.
- 입력 지원: Leptonica 라이브러리를 통해 PNG, JPEG, TIFF를 포함한 다양한 이미지 형식을 지원합니다.
- 출력 형식: 일반 텍스트, hOCR(HTML), PDF(투명 텍스트 전용 포함), TSV, ALTO, PAGE 등 다양한 출력 유형을 지원합니다.
- 개발자 통합: 맞춤형 애플리케이션 구축을 위한 C 및 C++ API를 제공하며, 다른 프로그래밍 언어를 위한 다양한 래퍼(wrapper)를 사용할 수 있습니다.
Tesseract는 GUI가 없는 도구이므로, 그래픽 인터페이스가 필요한 사용자는 서드파티 애플리케이션을 사용해야 합니다. 이 소프트웨어는 Apache License 2.0에 따라 라이선스가 부여됩니다.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.