ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Umi-OCR:把扫描 PDF 变成可搜索文档的免费离线 OCR 软件

Umi-OCR:把扫描 PDF 变成可搜索文档的免费离线 OCR 软件 Umi-OCR把扫描 PDF 变成可搜索文档的免费离线 OCR 软件【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR阅读器里的文字选不中扫描版 PDF 按 CtrlF 永远没有反应一堆图片里的文字只能靠手敲——这些麻烦正是 Umi-OCR 要解决的。它是一款免费开源的离线 OCR 软件截图取字、批量转文字、扫描件变可搜索 PDF、二维码读写都在本地完成不依赖网络。手动处理的代价比想象中更高把论文里的一段话完整复制出来可能要翻好几个复制失败几十张发票上的金额和日期逐张录入表格一坐就是半天300 页的扫描教材每一页本质上只是一张图片阅读器自带的搜索形同虚设。Umi-OCR 的思路是把这四类活全收进同一个本地工具内置 RapidOCR 与 PaddleOCR 两套离线模型识别结果不回传服务器文件也不离开电脑。下文按先跑起来、再干活、最后看边界的顺序过一遍。如何解压即用离线 OCR 的启动步骤 下载发行包。提供.7z压缩包与.7z.exe自解压包两种后者在没有装压缩软件的机器上也能直接解开。解压到任意目录不需要任何安装流程。Windows 上双击Umi-OCR.exe进入主界面Linux 用户运行umi-ocr.sh启动脚本。第一次打开时界面语言会跟着系统走。要换界面语言或深浅色主题到「全局设置」的「语言 / 主题」里切换即可简中、繁中、英、日、俄、葡等语言都有。想从源码自己构建克隆仓库后照 README 里的构建说明走git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR从屏幕取字到一次识别几百张图片屏幕上的字框一下就拿走。打开「截图OCR」标签页用页面里提示的快捷键在屏幕上框住目标区域文字会落到右侧记录栏。每条记录都能改字划选多条可以一起复制左侧预览栏也支持鼠标划选。截图之外从别处复制的图片直接粘贴进来同样能识别。遇到多栏排版或代码截图时到设置里换「排版解析方案」「单栏-保留缩进」会把行首空格原样保留就是给代码准备的。结果总差几个字时依次试三招把对比度调高或转成灰度图、核对识别语言中英混排选混合语言包、换另一套内置引擎再跑一遍。成堆的图片拖进去排队跑。「批量OCR」页把整个文件夹拖入即可jpg、png、webp、bmp、tif 等常见格式都能进数量不设硬性上限几百张一起排进去也没问题。跑完看左侧列表每张图的耗时和状态一目了然保存格式在 txt、jsonl、md、csv 里挑csv 可直接进 Excel 表格。两个省时间的设置每张图右上角都盖着同一个水印 LOGO 的话用右栏的忽略区域编辑器按住右键画矩形把水印包住被框住的整块文字会直接略过省掉事后清理。超大长图跑不动把设置里的「限制图像边长」调大再拆几批排队跑比硬扛一张超长图快得多。大任务安排在夜里跑的话可以勾选「完成后自动关机」。扫描 PDF 怎么变可搜索文档 把 PDF 拖进「文档识别」标签页页眉页脚这类固定位置的杂字用忽略区域框掉等任务结束导出。你拿到的不是转好的纯文本而是一份双层可搜索 PDF原来的扫描页作为图像层完整保留版式、插图和字体都保持原样OCR 则把每页文字转成一层透明文本叠在图像上方阅读器里看到的还是扫描件但搜索索引指向那层透明文字CtrlF 能定位到具体页码文字也能整段复制。这一步全程由内置离线模型在本机跑完不碰网络。PDF 之外XPS、EPUB、MOBI、FB2、CBZ 这些格式同样支持跑完任务还能设置自动关机或休眠。个别 PDF 报无法处理时可以逐页导出成图片改走批量OCR 的路线绕过去再不行就升级版本兼容性修复通常跟在新版本里。二维码与条形码批量读码也能反手生成图里码不止一个或者手里攒了一摞带码截图一个一个扫很耗时。「二维码」标签页把图片拖进去即可一次批量读出全部内容一图多个码也没问题覆盖二维码、一维条码、PDF417 等约 19 种协议。反过来也简单把文本粘进「生成码」马上输出二维码图片宽高与纠错等级都可以指定。不想开窗口命令行与本地 HTTP 调用不开图形界面的话命令行直接调用主程序就行。把整个文件夹识别到同一个文件里umi-ocr --path D:/images --output D:/result.txt程序化调用有另一条路内置的 HTTP 接口只在本机环回上监听不经过物理网卡图片识别和文档识别都支持。注意它对并发不友好脚本里请串行调用。参数细节看 命令行手册 和 HTTP 接口手册。这些情况别硬上能力边界提前说清 ⚠️识别率和输入质量强绑定艺术字、潦草手写有天然上限参数救不回来。大文件和超长图比较吃内存4GB 以下内存的机器建议缩小单批数量或把「限制图像边长」调低。语言包覆盖中、英、日、韩、法、德等常用语言小语种内容选混合语言包效果更稳。更细的参数与用法看 README实际使用中遇到问题去项目社区提 Issue 即可。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表