Umi-OCR免费离线批量文档转换:扫描件和图片一键变可搜索文字 📅 发布时间:2026/8/20 18:31:02 👁 浏览次数: Umi-OCR免费离线批量文档转换扫描件和图片一键变可搜索文字【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR先给结论Umi-OCR 是一款免费、开源的离线 OCR 软件核心功能是批量 OCR 和文档转换——把图片、扫描版 PDF 里的文字成批提取成可搜索、可复制的文本全程不联网。识别引擎是 PaddleOCR / RapidOCR 这类本地插件断网照跑敏感资料不用上传任何云端这是它和在线识别工具最本质的区别。为什么需要它扫描件本质是一堆图片的合订本文字烙在像素里想复制没门想全文搜索更没门。你只有两条路人工对着屏幕敲或者交给 OCR。而 Umi-OCR 的姿势是解压即用双击 Umi-OCR.exe 就启动Windows 和 Linux 都能跑没有安装向导也没有环境配置。解压即用先花两分钟把这两处设置调顺第一次启动会按你系统的语言自动切换界面不用管。真正影响识别效果的是页面右侧设置面板里的两个选项。第一处是识别语言。中文资料选简体中文外文资料选对应语种中英混排的文档务必选带英文的配置准确率肉眼可见地涨。第二处是限制图像边长默认 960它会把边长超标的图片压缩后再识别小图跑得快但大图容易糊字。你要处理像素超大的长截图或扫描大图就把它调到 2880 甚至 4320PaddleOCR 引擎下有效精度立刻上来代价只是单页慢零点几秒值得。批量OCR整个文件夹一次倒成文字这是我最常用的页。把存图片的文件夹整个拖进左侧列表支持 jpg、png、webp、bmp、tif、tiff没有数量上限几十上百张随便塞。右侧选好输出格式txt、jsonl、md、csvExcel随你挑点开始任务即可。我的错误做法 vs 正确做法最早一张张截图识别、再手动粘进文档十张图忙半小时后来改成整文件夹拖入、一键任务同样十张图几十秒跑完还顺带显示每张的置信度低分的自己心里有数。任务挂后台还能设置完成自动关机或待机晚上睡觉前丢进去第二天早上收结果 顺带一提图片带水印或 LOGO 时用忽略区域把那些位置框掉识别结果就不会混进广告文案。这个功能在文档识别里同样能用专门用来排除页眉页脚。扫描版PDF转双层可搜索PDF一个开关的事文档识别页处理的是 pdf、xps、epub、mobi、fb2、cbz 这类整本书格式。把扫描版 PDF 拖进去保存格式选双层可搜索PDF开始任务逐页跑完就能收成品。双层PDF的思路很直接底层原样保留扫描图像观感打印不变上层叠一层透明不可见的文字让搜索和复制成为可能。使用前 vs 使用后扫描件 CtrlF 搜词一无所获双层PDF 秒出结果还能选中复制排版一个像素都没动。有页眉页码混进正文忽略区域框掉还能限定生效的页码范围。只想处理中间某几页OCR 页数起止范围填一下就行不用整本硬啃。截图取字快捷键按下文字就到手网页、聊天记录、论文截图想提取文字不用保存文件再导入——截图OCR 页用快捷键直接框选屏幕识别结果实时高亮在原图上右键复制。图片还在原处文字已到手。识别代码截图有个专属方案排版解析选单栏-保留缩进行首缩进和行中空格原样保留贴回编辑器不用重新排格式不乱。识别结果不对先查这几处文本乱序、丢行、方向颠倒十有八九不是引擎不行是参数没对上。双栏论文被识别成单行串读把排版解析换成多栏系列自动按栏还原阅读顺序代码截图缩进丢了换成单栏-保留缩进。页面带旋转或倾斜启用纠正文本方向PaddleOCR 引擎下有效整页都乱且文档混排了图片和原生文本把内容提取模式改成整页强制OCR。加密 PDF 跑不动在参数里填文档密码。大图字糊回去把限制图像边长调高。这些选项都藏在设置面板里一次调对后面整批受益。把重复劳动交给一条命令固定目录、固定设备要反复识别命令行帮你把这步也自动化了。Umi-OCR 依赖本地 HTTP 服务做进程间通信默认开启、仅本地回环不经过物理网卡数据不会出机器。命令行入口就是主程序本身# 识别指定文件夹下所有图片结果写入 txt--clip 改为复制到剪贴板 umi-ocr --path D:/扫描件 --output D:/结果.txt # 快捷键截屏识别结果直接进剪贴板 umi-ocr --screenshot --clip路径可以传多个图片、文件夹混着来二维码也能命令行处理--qrcode_read 读码、--qrcode_create 生成宽高可指定。要对接更复杂的流程还有 HTTP 接口可用端口 1224文档识别走上传→轮询→下载→清理四步适合写脚本。现在就可以动手下载 Umi-OCR_Rapid_v2.1.5.7z解压双击 Umi-OCR.exe把存扫描件的文件夹拖进批量OCR页点开始任务。批量文字化这件事从此只需要两步拖拽。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考