paddleocrPaddlePaddle
신규PaddleOCR는 PaddlePaddle에서 개발한 종합 OCR 및 문서 AI 툴킷으로, PDF와 이미지를 LLM 호환 JSON/Markdown 형태로 변환합니다. PP-OCRv6, PaddleOCR-VL, PP-StructureV3 등 핵심 구성요소를 포함합니다.
우수한 오픈 소스 프로젝트를 발견하고, 익명으로 프로젝트를 제출하며, 내 프로젝트를 신청해 편집하세요.
호기심으로 오픈 소스의 세계를 발견하세요.
THE FIRST COLLECTIONPaddleOCR는 PaddlePaddle에서 개발한 종합 OCR 및 문서 AI 툴킷으로, PDF와 이미지를 LLM 호환 JSON/Markdown 형태로 변환합니다. PP-OCRv6, PaddleOCR-VL, PP-StructureV3 등 핵심 구성요소를 포함합니다.
MinerU는 PDF, 이미지, DOCX, PPTX, XLSX를 LLM, RAG, 에이전트 워크플로용 구조화된 Markdown/JSON으로 변환하는 오픈소스 문서 파싱 엔진입니다. VLM+OCR 듀얼 엔진, 109개 언어 OCR, 프라이빗/오프라인 배포를 지원합니다.
ByteDance의 오픈소스 문서 이미지 파싱 모델(ACL 2025)로, PDF와 촬영된 페이지를 레이아웃, 읽기 순서, 텍스트, 표, 수식, 코드를 포함하는 구조화된 Markdown/JSON으로 변환합니다.