paddleocrPaddlePaddle
新收录PaddleOCR 是由飞桨开发的全能 OCR 和文档 AI 工具包,可将 PDF 和图像转换为 JSON 或 Markdown 格式的结构化数据。核心组件包括:支持 100+ 语言的 PP-OCRv6、0.9B 参数的视觉语言模型 PaddleOCR-VL、细粒度坐标感知的 PP-StructureV3,以及轻量的 HPD-Parsing。支持多硬件平台和 ONNX/OpenVINO/TensorRT 部署,可集成 Dify、RAGFlow 等平台,并提供浏览器端 SDK PaddleOCR.js。