
Umi-OCR 离线OCR使用指南三分钟跑起来截图、批量、扫描PDF一次搞定【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR扫描件要识别得先上传到在线服务免费版有次数限制文档还出了自己的电脑屏幕上的文字想复制截图一贴又没了着落。Umi-OCR 解决的就是这两类麻烦免费开源的离线 OCR 工具解压即运行识别全程在你本机完成。 从安装包到第一条识别结果获取 Umi-OCR 有两种方式推荐第一种压缩包直装推荐发布包是.7z压缩包或.7z.exe自解压包没装压缩软件也能直接跑。解压后双击Umi-OCR.exe启动全程不装任何东西。Windows 7 x64 及以上、Linux x64 都能用。Scoop 命令行Windows装好 ScoopWindows 下的命令行应用管理器后下面两行就能装完。默认包自带 Rapid-OCR 引擎兼容性好另有速度稍快的 Paddle-OCR 版本可选。scoop bucket add extras scoop install extras/umi-ocr源码方式开发者向想改代码或构建再拉源码。git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR首次启动会加载 OCR 模型稍慢属正常之后启动很快。开工前把三件事设好界面语言全局设置→语言/Language。首次打开按系统语言自动匹配想换繁中、英语、日语随时改。OCR 引擎在引擎选项里二选一Rapid-OCR 兼容性更好Paddle-OCR 速度略快日常用默认即可。截图快捷键在截图 OCR标签页把唤起截屏的热键改成你顺手的组合默认是CtrlAltZ。然后完成第一个任务切到截图 OCR标签页按快捷键框选屏幕上的一块文字松手后结果出现在右侧识别记录里Esc可取消本次框选。识别结果同时进入剪贴板直接粘进文档就行。 三个任务屏幕提取、批量转文本、扫描件数字化把 200 张图片一次变成可搜索的文本文件适用手上有一批扫描图、票据照片、截图存档都要变文字。批量 OCR标签页是批量图片转文本的主力入口。打开批量 OCR标签页把图片文件拖进列表右栏选好输出格式txt / jsonl / md / csv和识别语言启动任务完成后到指定目录查看结果。关键参数无数量上限一次拖几百张jpg、jpeg、png、webp、bmp、tiff 等常见格式都收txt 给人读csv 可直接用 Excel 打开jsonl 留给脚本处理可设任务完成后自动关机或待机晚上挂机跑文档正合适。做完你会得到一整个目录的文本文件每张图片对应一份结果直接全文检索。屏幕上的文字随时提取粘贴图片也能识别适用屏幕上想抄一段文字却选不中或者剪贴板里刚复制了一张图片想变文字。按CtrlAltZ唤起截屏框选目标区域松手后结果进入右侧记录可编辑文字支持跨多条记录划选复制左侧图片预览区同样可以用鼠标划选直接复制。关键参数别处复制的图片直接粘贴进截图 OCR 页就能识别不用先存成文件支持重复上一次截图连续处理相邻区域时省得重复框选识别语言按图片内容选中英混杂的图选包含中英文的组合准确率明显更高。做完后文字同时进了剪贴板和页面记录剪贴板里那份拿去粘贴记录里那份留着以后翻。把扫描版 PDF 变成能搜索的双层文档适用手头是扫描出来的纸质文档想按关键词搜、想摘录段落。文档识别标签页支持 pdf、xps、epub、mobi、fb2、cbz 六类格式。打开文档识别标签页把文档加入列表输出类型勾选双层可搜索 PDF带页眉页脚的文档先画好忽略区域再启动任务。关键参数扫描版走 OCR 流程电子 PDF 直接提取原有文本两类文档扔进去都能处理输出的 PDF 保留原始版式文字层可被搜索、可选中。做完你拿到一份新 PDF外观和原来一样但鼠标能选字、能搜词纸质文档就此变成电子档。⚙️ 两个直接影响结果质量的调整水印、页码混进文本用忽略区域画框批量识别带 Logo、水印、页码的文档时这些干扰文字会跟着进结果。做法在批量 OCR 页右侧设置中打开忽略区域编辑器按住鼠标右键画出矩形把水印可能出现的位置全部罩住可以多画几个框。规则是只有完整地落在框内的文本块会被跳过框外的内容不受影响所以框尽量画大一点。文档识别页也能设同样的忽略区域专门用来去掉页眉页脚。双栏论文、代码截图的顺序乱了换排版解析方案OCR 引擎给出的文本块顺序不一定符合阅读习惯文本后处理里的排版解析方案负责理顺多栏-按自然段换行自动识别双栏布局论文、报告的大多数场景选它就够多栏-总是换行/多栏-无换行每句强制换行或全部合并成一行单栏-保留缩进代码截图识别专用保留行首缩进和行内空格结果能直接粘进 IDE不做处理保留引擎原始输出。以上方案都能自动处理横排和从右到左的竖排文字竖排还需要引擎本身支持。 用脚本调 Umi-OCR命令行与 HTTP命令行入口就是Umi-OCR.exe多数系统直接写umi-ocr前提是全局设置里的本地 HTTP 服务处于开启状态——默认开启主机保持仅本地即可通信只走系统环回不经过网卡。最常用的三条umi-ocr --path D:/images --output result.txt umi-ocr --screenshot --clip umi-ocr --qrcode_create 文本内容 D:/qr.jpeg第一条识别文件夹内所有图片含子文件夹并把结果写进文本文件第二条框选屏幕、结果复制到剪贴板第三条由文本生成二维码图片。--output_append追加写入已有文件--qrcode_read扫图片里的码--help打印完整参数表。要写脚本自动调用走 HTTP 接口文档里的/argv接口即可效果等价于拼一条命令行。完整参数见 命令行使用手册。⚠️ 大批量之前先核对的六件事硬件门槛4GB 内存起步CPU 越强识别越快不需要显卡。输入质量扫描文档 300dpi 以上模糊图片调什么参数都救不回来。批量策略图片量大时按每批 50~100 张分次跑比一次硬塞更稳。超长图识别不全在页面设置 → 文字识别里调高限制图像边长的数值。输出格式怎么挑jsonl 给脚本、txt 给人读、csv 导入 Excel 统计。截屏闪烁或 UI 错位去全局设置更换渲染器或关闭硬件加速。✅ 该装它的人和文档入口需要把扫描合同、票据数字化的办公人员要从 PDF 论文里提取参考文献、重要段落的学生和研究人员想在自动化流程里批量处理图片文字内容的开发者不想把任何文档上传到云端的隐私敏感用户。常用资源命令行使用手册 · HTTP 接口文档 · 更新日志离线 OCR 的意义是文档从头到尾不出你的电脑。解压、双击、三分钟第一个识别任务就落在剪贴板里了。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考