ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Umi-OCR:免费离线文字识别,解压后三步跑完第一次识别

Umi-OCR:免费离线文字识别,解压后三步跑完第一次识别 Umi-OCR免费离线文字识别解压后三步跑完第一次识别【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR想让扫描件合同里的一行字能被选中光标落下去却没反应想把教程截图里的一段话复制走只能对着屏幕手打一遍。Umi-OCR 就是干这个的免费、开源、离线文字识别工具截图、扫描件、PDF 都能变成可复制的文字不联网图片也留在你自己电脑上。上手成本解压后 3 步完成首次识别全程没有安装步骤也不联网3 分钟以内可以走完从项目发布渠道拿到最新发布包.7z压缩包和.7z.exe自解压包都可以。解压到任意目录路径里避开中文Windows 双击Umi-OCR.exe启动Linux 下运行umi-ocr.sh。打开截图OCR标签页按快捷键框选你要的文字识别结果直接进入剪贴板。到这里第一次识别就完成了——出来的字是可以直接粘贴的文字不是图片。“截图OCR”标签页左侧是框选的截图右侧记录区逐条给出置信度和时间可以划选多条一起复制。 能力地图Umi-OCR 能替你干掉的 5 件事截图与剪贴板识别你手头正好有一段教程截图里的文字要搬到别处时打开“截图OCR”快捷键框选结果直接进剪贴板下一步就是 CtrlV。从别处复制的图像也能粘贴进识别区。右侧每条记录都标着置信度和时间可以编辑也能划选多条一起复制不必一条条处理。批量转换文件夹里的图片你手头正好有一个装着几百页扫描件的文件夹、想一次变成文本文件时“批量OCR”一次性导入jpg、png、bmp、tiff、webp 都能读数量不设上限。结果可以导出为 txt、md、jsonl、csv(Excel)还能勾选任务完成后自动关机晚上挂上睡醒收工。批量 OCR 页左侧列出每个文件的耗时与置信度右侧显示每张图的识别结果顶部是整体进度 3/13。图片型 PDF 变双层可搜索 PDF你手头正好有一份选不中字的图片型 PDF 合同或论文时走“文档识别”pdf、xps、epub、mobi 都能导入。它能抽出原有文本也能对扫描件整体 OCR产出是双层 PDF底层保留原版式顶层是可选择的文字层。再配合忽略区域页眉页脚也能一并剔掉。19 种码制的读取与生成你手头正好有一张图片里的二维码死活扫不出来或者想把一段文本做成二维码图片时用“二维码”页截图、粘贴、拖入图片都行一张图里多个码也能一起读覆盖 QR、EAN13、Code128 在内的 19 种码制。反过来输入文本生成二维码也可以纠错等级能调。把识别能力塞进你自己的脚本如果你是开发者、想把文字识别写进自己的流程主程序本身就是 CLI 入口指向文件或文件夹即可识别也能直接截图识别umi-ocr --path D:\images umi-ocr --screenshot umi-ocr --qrcode_create 文本内容 D:\code.png另外还有一组 HTTP 接口别的程序发个请求就能拿到识别结果。 排障与调参常见现象对照表大部分识别效果问题不是引擎的错是参数没选对现象调整位置效果截图闪烁、界面错位全局设置 → 界面和外观切换渲染器或关闭硬件加速换成更稳的软件渲染界面不再闪长图、超清大图只识别了一部分批量 OCR 页设置里的“限制图像边长”调高上限大图不再被截断双栏论文的文字顺序读乱排版解析方案选“多栏-按自然段换行”按栏顺序阅读段落不再串位代码截图的缩进丢了排版解析方案选“单栏-保留缩进”缩进原样保留粘进编辑器即可用水印、页眉文字混进结果“忽略区域”编辑器按住右键画矩形框框内完整包含的文本块被剔除框要画大些命令行敲了没反应全局设置里确认 HTTP 服务已开启服务默认开启通信只在本地环回界面显示成英文全局设置 → 语言简中、繁中、英文、日文等可切换某些语言漏字全局设置里换另一套 OCR 引擎确认语言包覆盖目标语言后重新识别先想清楚再装谁用它最划算这类人用它最值经常把合同、票据、扫描件数字化的人图片和结果都留在本机磁盘不上传任何云端要从扫描版论文里抽正文、还要批量处理的人批量 OCR 不设数量上限还能跑完自动关机想把文字识别编进脚本或工作流的人主程序自带 CLI 入口另有 HTTP 接口给别的程序调用这些情况先别碰用 Mac 的官方只有 Windows 7 x64 和 Linux x64 版本没有 Mac 原生包期望识别完直接还原出 Word 排版的它只输出文字不做版面还原严重模糊、畸变的低质量照片任何离线 OCR 引擎在这类图上都会吃力资源入口仓库、文档与社区在哪找仓库源码git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR——想翻源码、核对行为或提代码时用更新日志CHANGE_LOG.md——升级新版本前后对照新特性和修复项命令行手册docs/README_CLI.md——写脚本时查参数和示例HTTP 接口手册docs/http/README.md——其他程序要调识别服务时看请求格式社区渠道Bug 和建议在仓库提 Issue界面翻译在 Weblate 平台协作想补翻译就去那边【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表