5 分钟把图片里的文字变成可复制文本:免费离线 OCR 工具 Umi-OCR 完整指南

5 分钟把图片里的文字变成可复制文本:免费离线 OCR 工具 Umi-OCR 完整指南 5 分钟把图片里的文字变成可复制文本免费离线 OCR 工具 Umi-OCR 完整指南【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费、开源的离线 OCR 软件不用联网、不用安装解压后就能把截图、照片、扫描版 PDF 里的文字识别成可复制的文本。它是什么解决什么问题Umi-OCR 是一款跑在 Windows 7 x64 和 Linux x64 上的文字识别工具识别引擎和语言库全部内置在本机你的截图和文档不出电脑不经过任何服务器绿色版设计解压后运行Umi-OCR.exe就能用迁移到别的机器直接拷走整个文件夹覆盖截图、批量图片、PDF 文档、二维码四类识别需求装好就能覆盖的三个场景日常随手取字用得最多PPT 里的字复制不了、图表看不清截个图几秒后文本就在剪贴板里一次消化一堆图片把几十张聊天截图、票据照片拖进批量页排队自动识别每张带置信度分数最后存成一个 txt 或 csv扫描版 PDF 要编辑低频但刚需把无法选中文字的扫描 PDF 转成双层可搜索 PDF原文外观不动新增的文字层能搜索、能复制从零到出第一个结果截图 OCR 标签页左侧预览可划选右侧记录可编辑右键即可复制从发布页下载.7z包解压双击Umi-OCR.exe启动全程无安装向导停留在默认的截图OCR标签页点左上角截图按钮框选屏幕区域按Esc可取消识别完成后右侧记录面板出现结果可直接编辑文字、跨多条记录划选复制左侧预览图上CtrlC也能复制所选文本块核心功能详解截图 OCR框一下就有结果它是默认打开的标签页除了鼠标截图还支持把别处复制的图片直接粘贴进来识别。关键在右侧设置面板里的OCR 文本后处理→排版解析它负责整理多栏排版的阅读顺序。多栏-按自然段换行适合大部分场景识别代码截图时换成单栏-保留缩进行首空格和缩进都会保留。批量 OCR让几百张图排队干活批量 OCR 标签页左侧是任务列表耗时、置信度右侧是识别记录拖入图片jpg、png、webp、tif 等格式数量不设上限点开始任务。列表里每个文件都标出耗时和置信度如 0.92点任意一条可在右侧查看细节。结果可存为 txt、jsonl、md、csv也可拆成单独文件。如果每张图都有固定位置的水印先在忽略区域里按住右键画矩形框内文字会被整体剔除注意剔除单位是整个文本块不是单个字符。跑通宵任务前记得勾选任务完成后自动关机。文档识别给扫描 PDF 加一层可搜索文字文档识别标签页支持 pdf、xps、epub、mobi 等格式。拖入文件后可选提取原有文本或整页强制 OCR输出双层可搜索 PDF——视觉层保持原样文字层覆盖其上可全文搜索。页眉页脚同样能用忽略区域排除并可指定作用页码范围。二维码读码和造码一个标签页搞定扫码支持 QRCode、DataMatrix、PDF417 等 19 种协议一张图里多个码也能全部读出来反向输入文本即可生成二维码图片纠错等级和图片尺寸都能调。配置与个性化什么时候改什么全局设置标签页语言、主题、字体、界面大小比例都在这里调整语言首次启动跟随系统语言若弹出了不想要的界面去全局设置→语言/Language切换可选简体中文、繁体、英语、日语等主题与渲染内置多套亮/暗主题若截图时闪烁或界面错位到界面和外观→渲染器切换渲染方案或关闭硬件加速引擎Paddle-OCR 与 Rapid-OCR 两套引擎在全局设置里切换也可从插件库导入其他引擎插件边长限制超大图默认会被缩放后再识别发现长图小字丢字时到批量页页面设置→文字识别→限制图像边长把数值调高面向开发者主程序本身就是命令行入口直接传图片路径并把结果写入文件Umi-OCR.exe --path D:/img.png -- result.txt也可以让命令行发起截图、结果直进剪贴板Umi-OCR.exe --screenshot --clip。需要远程调用时软件自带 HTTP 服务默认开启主机为仅本地图片识别、文档识别、二维码接口都有文档详见 命令行手册 与 HTTP接口手册。常见问题识别出来的文字顺序乱七八糟怎么办在文本后处理里选对排版解析方案。默认不做处理输出的是引擎原始结果每行独立一条。长截图里的小字为什么识别不全多半是限制图像边长把它缩小了在批量页设置里调高限值再跑一次。用命令行或 HTTP 调用会不会泄露数据通信只走本机环回不经过网卡HTTP 主机默认仅本地想开局域网访问才需手动切换。Linux 上能用吗可以支持 x64 发行版也提供 Docker 部署方式glibc 依赖降到 2.31Debian 11、Ubuntu 20 等旧系统可跑。生态与更新当前版本 v2.1.52025-03-26近期新增了日志机制、多数标签页的双栏布局以及俄语、泰米尔语两个界面语言。路线图上排着表格识别输出 Excel、图片翻译、GPU 加速与 macOS 兼容。界面翻译由 Weblate 平台协作维护已覆盖十余种语言遇到问题到项目 Issue 页提交即可。如果你受够了截图和 PDF 的复制限制现在就可以把 Umi-OCR 下载下来解压后从截图OCR开始试——这款免费离线 OCR 工具从一张截图到一批文档都能接住。核心关键词OCR软件、免费OCR、离线文字识别、批量OCR、PDF识别长尾关键词截图文字识别、图片转文字工具、PDF转可编辑文档、开源OCR项目、Windows OCR软件、Linux OCR工具、批量图片识别、文档数字化、文字提取工具、多语言OCR【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考