Umi-OCR:免费离线OCR文字识别工具,截图、批量、PDF一次搞定

Umi-OCR:免费离线OCR文字识别工具,截图、批量、PDF一次搞定 Umi-OCR免费离线OCR文字识别工具截图、批量、PDF一次搞定【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费、开源、离线的 OCR 文字识别软件所有识别在本地完成无需联网。它支持截图识别、批量图片识别、PDF 文档识别和二维码扫描生成还能排除水印与页眉页脚适合日常文字提取与文档数字化。项目速览Umi-OCR 是一款绿色便携的离线 OCR 软件覆盖从单张截图到整批文档的识别场景主要特性包括完全免费开源解压即用离线运行识别内容不经过网络。支持 Windows7 x64 与 Linux x64兼容范围较广。五大功能模块截图OCR、批量OCR、PDF文档识别、二维码、公式识别。内置 PaddleOCR、RapidOCR 等离线引擎与多国语言识别库。提供命令行与 HTTP 接口方便被其他程序调用。文本后处理可自动整理多栏排版批量识别支持忽略区域排除水印。安装与首次运行整个流程不需要安装四步即可开始第一次识别获取软件从 README 中的发行版地址下载.7z压缩包或.7z.exe自解压包。自解压包在没有安装压缩软件的电脑上也能直接用。解压部署将文件解压到任意目录例如D:\Umi-OCR。程序不写注册表整个文件夹拷走即可迁移。启动程序双击Umi-OCR.exeLinux 下为umi-ocr.sh。首次启动会按系统语言自动切换界面也可在全局设置 → 语言中手动改为中文、英文、日文等。完成第一次识别打开截图OCR标签页按快捷键框选屏幕区域识别结果会出现在右侧记录栏可直接划选复制或编辑后复制。核心功能解析截图OCR与排版解析截图OCR 面向随手提取屏幕文字的场景。你可以按快捷键框选区域截图也可以在其他地方复制图片后粘贴进来识别。识别结果支持在右侧记录栏中编辑、多选合并复制。配套的文本后处理 - 排版解析能整理识别出的文字顺序多栏文档可自动识别分栏并按自然段换行代码截图有保留缩进方案竖排文字也能自动处理。默认选择多栏-按自然段换行即可覆盖大部分情况。适合需要频繁从网页、电子书、软件界面中抄文字的用户。批量OCR与忽略区域批量OCR 标签页用于一次处理本地大量图片支持 jpg、png、webp、bmp、tif 等格式没有数量上限。识别结果可保存为 txt、jsonl、md、csv(Excel) 四种格式任务完成后还可设置自动关机或待机。针对带水印、LOGO 的图片可用忽略区域功能在页面右栏设置中打开编辑器按住右键画若干矩形框框内的整个文本块会被跳过。建议把框画得稍大一些完全包住水印可能出现的位置。适合需要批量转换扫描件、照片、截图为文字的用户。文档识别PDF识别文档识别页专门处理 PDF、epub、mobi 等文档文件。它对扫描件做 OCR或直接提取 PDF 原有文本输出为双层可搜索PDF——既有原始排版又能全文搜索。该页面同样支持忽略区域常用来排除页眉页脚并支持任务完成后自动关机。适合把纸质档案、扫描合同、电子教材转成可检索文档的用户。识别接口细节可参考 HTTP接口手册。二维码识别与生成二维码页支持两个方向一是从截图、粘贴或拖入的图片中识别二维码与条形码支持一图多码和 19 种编码协议二是输入文本生成二维码图片可调纠错等级与尺寸。适合经常核对文档中链接码、需要自制二维码的场景。命令行与HTTP接口除了图形界面Umi-OCR 还能被外部调用命令行支持截图识别、指定路径批量识别、二维码读写等指令umi-ocr --help可查看全部HTTP 接口提供图片OCR、文档识别、二维码的 REST 接口服务在全局设置中默认开启仅本地环回通信。详细说明见 命令行手册 与 HTTP接口手册。实用技巧选对引擎发行版默认自带 RapidOCR 引擎兼容性好对准确率要求更高时可安装 PaddleOCR 引擎插件二者可在全局设置 → 切换OCR插件中随时更换。处理超大长图识别像素很大的长图或大图前先在页面设置 → 文字识别 → 限制图像边长中调高数值否则图片会被压缩导致识别不全。忽略区域要画大只有完整落在框内的文本块才被忽略画小会导致水印文字残留。界面异常时换渲染器若出现截图闪烁、UI 错位到全局设置 → 界面和外观 → 渲染器切换渲染方案或关闭硬件加速。留意日志v2.1.5 起提供日志机制启动日志保存在UmiOCR-data/logs目录保存级别可在全局设置中调整排障时先查这里。常见问题Q识别准确率不理想文字缺字、乱序怎么办先确认图片本身清晰、文字与背景对比度足够再检查识别语言库是否与图中文字匹配多栏文档请在文本后处理中选择多栏类排版解析方案让程序按正确顺序输出文字。Q软件无法启动或界面显示异常确认系统满足 Windows7 x64 或 Linux x64检查是否完整解压自解压包建议用管理员权限运行界面异常时先切换渲染器。仍无法解决查看日志文件再到项目 Issue 页面提交反馈附上日志与复现步骤会更快得到处理。Q命令行执行后没有结果命令行依赖本地 HTTP 服务通信请确认全局设置中的 HTTP 服务已允许且主机为仅本地默认开启。另外识别任务耗时较长一条命令结束前不要输入下一条。Q识别结果支持哪些保存格式批量OCR支持 txt、jsonl、md、csv 四种文本格式文档识别支持输出双层可搜索PDF。也可以让结果复制到剪贴板直接粘贴到其他应用中。写在最后Umi-OCR 把截图、批量、文档识别放进一个免费离线的工具里覆盖大多数文字提取需求解压即可用。建议先从截图OCR上手再用批量页处理日常文档。使用中遇到问题或有功能建议欢迎到项目 Issue 页面反馈社区会持续跟进改进。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考