OPEN SOURCE, OPEN TO EVERYONE

好开源,值得被发现。

发现优质开源项目,匿名提交开源项目,认领编辑你的开源项目。

人工精选 · 发现好开源4109已发现

带着好奇心,发现开源世界。

THE FIRST COLLECTION
Topic: ocr清除
paddleocrPaddlePaddle
新收录

PaddleOCR 是由飞桨开发的全能 OCR 和文档 AI 工具包,可将 PDF 和图像转换为 JSON 或 Markdown 格式的结构化数据。核心组件包括:支持 100+ 语言的 PP-OCRv6、0.9B 参数的视觉语言模型 PaddleOCR-VL、细粒度坐标感知的 PP-StructureV3,以及轻量的 HPD-Parsing。支持多硬件平台和 ONNX/OpenVINO/TensorRT 部署,可集成 Dify、RAGFlow 等平台,并提供浏览器端 SDK PaddleOCR.js。

人工智能开发工具图像 / 音视频 AI
tesseracttesseract-ocr
新收录

Tesseract 是一款开源 OCR 引擎,提供命令行工具和库,支持 100 多种语言的图像文本识别。

人工智能开发工具图像 / 音视频 AI
pageledgerpeterbussch
新收录

PageLedger 是一个用于可审计的、页面级 OCR 和文档提取的 Python CLI 库。它记录每个提取页面的来源、质量信号和预算,支持可恢复运行、审查队列以及带人工参与验证的重新运行。

开发工具人工智能命令行与终端
mineruopendatalab
新收录

MinerU 是一款开源文档解析引擎,可将 PDF、图片、DOCX、PPTX 和 XLSX 转换为结构化 Markdown/JSON,服务于 LLM、RAG 和 agent 工作流。它支持 VLM+OCR 双引擎、109 种语言 OCR,以及私有化/离线部署。

人工智能开发工具RAG / 知识库
新收录

Tesseract.js 是一款支持 100 余种语言的 JavaScript 光学字符识别(OCR)库,可通过 WebAssembly 在浏览器和 Node.js 环境运行,是对独立 Tesseract OCR 引擎的封装,未修改其核心识别模型,也不支持 PDF 文件处理。

开发工具人工智能组件库
easyocrJaidedAI
新收录

EasyOCR 是一个开箱即用的光学字符识别库,支持 80+ 种语言和主流书写系统,提供简单的 Python API 和命令行工具,基于 PyTorch 的检测与识别模型,并支持自定义训练。

人工智能开发工具图像 / 音视频 AI
新收录

X-AnyLabeling 是一款轻量级、统一的跨平台桌面应用,用于 AI 辅助数据标注,支持文本、图像、视频和多模态数据,内置多种深度学习模型与丰富标注工具,并支持多格式导入导出。

人工智能开发工具训练 / 微调 / 评测
aksharamdK2alyan
新收录

AksharaMD是一个本地运行的解析器无关工具,用于评估文档解析器将源文件转换为AI友好型Markdown的质量,提供每文档就绪评分、块级来源标签、命名警告以及可选的基于源文件的接受/拒绝判定。

人工智能开发工具RAG / 知识库