这个项目能做什么

Umi-OCR 是一款免费、开源的离线文字识别(OCR)软件,适用于 Windows 7 x64 与 Linux x64 平台。项目强调解压即用、无需联网,并内置多种语言的离线识别库。 主要功能: - 截图 OCR:通过快捷键唤起截图并识别图中文字,支持粘贴图片识别,识别记录可编辑与多选复制。 - 文本后处理:提供多种排版解析方案,可自动识别多栏布局、按自然段换行、保留缩进等,并支持横排与竖排(从右到左)排版。 - 批量 OCR:支持 jpg、png、webp、bmp、tif 等常见图片格式批量导入,结果可导出为 txt、jsonl、md、csv(Excel),无数量上限,支持任务完成后自动关机或待机。 - 忽略区域:可在批量识别中绘制矩形框,排除水印、LOGO 等干扰文字。 - 文档识别:支持 pdf、xps、epub、mobi、fb2、cbz 等格式,可从扫描件提取文本或输出双层可搜索 PDF,并支持忽略区域排除页眉页脚。 - 二维码:支持读取与生成二维码/条形码,覆盖 19 种协议,支持一图多码与纠错等级设置。 - 全局设置:可切换界面语言、主题、字体大小,切换 OCR 插件,调整渲染器以解决截屏闪烁或 UI 错位问题。 调用方式:提供命令行手册与 HTTP 接口手册,便于外部程序集成。 支持的离线 OCR 引擎包括 PaddleOCR-json 与 RapidOCR-json,运行环境基于定制版 PyStand。项目使用 Weblate 平台进行界面本地化翻译协作,支持多国语言界面。