Umi-OCR 离线OCR软件:免费截图识别、批量PDF转文字完整指南

Umi-OCR 离线OCR软件:免费截图识别、批量PDF转文字完整指南 Umi-OCR 离线OCR软件免费截图识别、批量PDF转文字完整指南【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR把一页扫描件敲进文档连校对在内要十分钟起步把图片传到在线识别服务文件从此落在别人的服务器上存多久、谁见过你说了不算。Umi-OCR 是免费开源的离线OCR软件识别引擎整套装在自己电脑里不注册、不限额图片不出本机。解压即用三步把 Umi-OCR 跑起来下载项目发布页提供.7z压缩包电脑没装压缩软件就选.7z.exe自解压包双击自动解开。解压放到任意纯英文路径例如D:\Tools\Umi-OCR路径里别带中文和空格。启动Windows 双击Umi-OCR.exeLinux 运行umi-ocr.sh。系统要求 Windows 7 x64 以上或 Linux x64无需联网。主窗口由一排标签页组成——截图OCR、批量OCR、文档识别、二维码、全局设置打开哪个用哪个右上角可锁定标签防误关也可让窗口置顶。首次启动会跟随系统语言显示界面之后想换随时改。老手建议首次启动前把软件目录加进杀毒软件排除项。发行包内置识别引擎和运行库个别杀软会误报拦截这也是软件闪退最常见的来源。四个高频使用场景截图OCR屏幕上的字直接抓下来解决的是复制不了的字PDF 阅读器、视频画面、图片里的文字都先框一下再说。打开截图OCR标签页按快捷键唤起截图框框住目标区域识别结果立刻出现在右侧记录栏。两个顺手的小习惯不截图也行——在别处复制一张图片比如聊天窗口里的图回到软件直接粘贴照样识别。记录栏文字可逐条编辑、划选多条一起复制识别完顺手整理成想要的格式不用跳去别的编辑器。批量图片识别几百张图一次拖进来一张一张截图太亏切到批量OCR标签页把图片直接拖进窗口jpg、png、webp、bmp、tif、tiff 都收数量没有上限。点开始任务右侧逐张显示耗时、置信度和识别结果。跑完可导出 txt、jsonl、md、csv 四种格式csv 直接用 Excel 打开过夜挂机可设任务完成后自动关机或待机。v2.1.2 起支持暂停任务——软件不退出待机/休眠后接着跑。扫描版 PDF 转文字双层可搜索 PDF 怎么导出文档识别标签页解决扫描版 PDF 搜不到、复制不了的死结。支持pdf、xps、epub、mobi、fb2、cbz六种格式。底层流程分三步解析引擎底层依赖 PyMuPDF先把文件拆成现成文本层和需要识别的图片层扫描页交给本地引擎逐页识别再按阅读顺序重组输出你指定的格式。双层可搜索 PDF底层是原图、上层是透明文字外观和扫描件一模一样文字却能搜索、复制、划线。归档历史合同、论文数字化直接顶用。提取模式默认优先提取 PDF 自带文本层快、零识别误差纯扫描页自动切 OCR也可强制整页 OCR或反过来只提取原文本。v2.1.2 起还能输出单层纯文本 PDF体积小好编辑。页眉页脚混进结果按页码范围设置忽略区域即可排除任务完成自动关机同样支持。二维码扫码与生成截图、粘贴或拖入图片读取其中的二维码、条形码支持一图多码、19 种编码协议QRCode、EAN13、Code128 等。反向也行输入文本生成二维码图片纠错等级、尺寸都可设。调产出质量排版方案与忽略区域引擎吐出来的文字本来是散装的谁先谁后、要不要换行由排版解析方案决定。内置六套预设选对方案输出才符合阅读习惯排版方案适用场景多栏-按自然段换行两栏/三栏的论文书籍覆盖最广多栏-总是换行每句独立换行适合按行后续处理多栏-无换行全文强制合并成一行单栏-按自然段换行/总是换行/无换行单栏文档按段落断行单栏-保留缩进代码截图专用保住行首缩进和行中空格不做处理引擎原始输出默认每句换行横排、竖排从右到左的栏都能自动处理竖排文字前提是识别语言库支持该语言。老手建议拿不准就选多栏-按自然段换行识别代码截图直接切单栏-保留缩进缩进基本原样保留。忽略区域是批量识别的降噪滤镜图片角落的水印、LOGO、页眉页脚每次都混进结果在这里一次框掉。打开批量页右侧设置的忽略区域编辑器按住右键画多个矩形框框内文字识别时自动排除。要记住的机制只有整个文本块完全落在框内才会被忽略不是按单个字符算所以框宁可画大把水印可能出现的位置全部包住。出问题怎么查按症状对表 ✅别背报错先判断属于哪一类再查对应解法。结果不干净症状解法长图识别缺胳膊少腿在文字识别设置里调高限制图像边长别放大原图代码截图排版全乱排版方案切单栏-保留缩进忽略区域画了没效果框不够大整个文本块完全在框内才忽略或忘了保存配置识别不准先在全局设置里换引擎试试见下机器闹脾气症状解法截图闪烁、界面错位全局设置→界面和外观→渲染器切换渲染方案或关闭硬件加速几万文件的文件夹加载很卡v2.1.5 已优化异步加载等预览界面进度条走完再操作任务跑不完 / 调不动症状解法批量任务想中途休息v2.1.2 起支持暂停任务不退出软件待机/休眠后可继续命令行没反应确认全局设置里 HTTP 服务已开启默认开启仅监听本地环回入口必须是主程序Umi-OCR.exe备用启动器可能不支持进阶接入命令行与 HTTP 接口 命令行入口就是主程序指令支持简写--screenshot可写--sc。三个常用姿势umi-ocr --screenshot --clip umi-ocr --path D:/扫描件.png --output result.txt umi-ocr --qrcode_create 你好 D:/qrcode.png 256第一条截屏识别、结果直接进剪贴板第三条生成一张 256 像素二维码。完整参数见 docs/README_CLI.md。HTTP 接口方面软件启动后本地服务默认端口 1224提供图片 OCR、文档识别、二维码三类接口几十行代码就能封装成上传图片 → 返回 JSON的小工具详见 docs/http/api_doc.md。默认只监听本地环回需要局域网调用时才在设置里切换监听地址。引擎层面内置两套可切换的离线OCR引擎Rapid-OCR兼容性好和PaddleOCR速度稍快项目另有独立插件库可扩展更多识别后端数学公式识别也在远期计划里。两个容易混的设置界面语言管按钮菜单长什么样支持繁中、英语、日语、俄语、葡萄牙语等十余种在全局设置→语言/Language 切换识别语言库管引擎认哪种文字在各标签页的文字识别设置里单独选或下载两者互不影响。版本演进一览v2.1.0新增批量文档识别PDF 转文字能力上线v2.1.2批量任务支持暂停支持输出单层纯文本 PDFv2.1.3登陆 Linux 平台支持 Docker 部署v2.1.4PaddleOCR 插件默认把内存限制在系统总内存的一半以内v2.1.5新增日志机制优化数万个文件的文件夹加载修复旋转页文本错位详细记录见 CHANGE_LOG.md。手头有旋转过方向的扫描件直接用最新版。免费、开源、完全离线Umi-OCR 把屏幕上的文字还到你手里。再遇到复制不了的字不用上传打开它直接拿。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考