ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Umi-OCR离线OCR快速指南:5分钟完成图片文字识别与批量导出

Umi-OCR离线OCR快速指南:5分钟完成图片文字识别与批量导出 Umi-OCR离线OCR快速指南5分钟完成图片文字识别与批量导出【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR是一款免费、开源的离线OCR软件能从屏幕截图、本地图片和PDF文档中提取文字结果可导出为txt、csv等格式全程不联网。适合需要批量处理扫描件、截图和文档的办公人员、学生与开发者。项目速览Umi-OCR的主窗口以标签页组织截图OCR、批量OCR、文档识别、二维码、全局设置五个页面按需打开。发行包内置Rapid-OCR与Paddle-OCR两套离线OCR引擎并带有中、英、日等多国语言库识别在本地完成图片不会上传到任何服务器。下图是截图OCR页左栏是截图预览可以直接用鼠标划选文字右栏是识别记录支持编辑和划选多条记录复制。顶部标签栏可切换截图OCR与全局设置点击还能新建标签页。安装与准备发行包提供.7z压缩包或.7z.exe自解压包无需安装解压即用。解压后双击Umi-OCR.exe即可启动支持Windows 7 x64与Linux x64。Windows下也可以用Scoop从命令行安装只需两行scoop bucket add extras scoop install extras/umi-ocr首次启动时界面语言会按系统设置自动切换需要手动更改时进入全局设置→语言/Language即可。上手实操四步完成一次批量图片识别以识别一个文件夹里的全部图片并导出txt为例打开批量OCR标签页点击选择图片添加图片。支持jpg、jpeg、png、webp、bmp、tif、tiff等格式没有数量上限。在右栏设置里选择保存格式txt、jsonl、md、csv与保存位置。点击开始任务。顶部会显示进度条与总耗时右栏记录区可以逐张查看每张图的识别结果。任务结束后指定文件夹中生成与图片同名的txt文件。如果只想识别屏幕上的一小块文字打开截图OCR标签页按快捷键Windows下默认WinAltC框选区域识别完成后在右栏记录区直接复制文字即可。上图是一次已完成的批量任务13张图片识别完毕列表里能看到每张图片的耗时与状态。进阶用法排版解析方案。截图OCR和批量OCR页都有OCR文本后处理选项可切换预设排版方案多栏-按自然段换行能自动识别双栏版式适合报纸、论文单栏-保留缩进面向代码截图保留行首缩进和行中空格。忽略区域。带水印、LOGO或页眉页脚的图片可以在批量页右栏设置中进入忽略区域编辑器按住右键绘制多个矩形框住水印位置框内的文本块会在任务中被跳过。文档识别页同样支持设置忽略区域用来排除页眉页脚还能把扫描件输出为双层可搜索PDF。命令行与HTTP接口。主程序本身就是命令行入口例如识别一张图片并写入文件umi-ocr --path D:/img.png --output out.txt--path也可以传文件夹路径递归识别其中所有图片--screenshot执行截图识别--clipboard识别剪贴板里的图片。需要让其他程序调用OCR时可改用HTTP接口。常见问题问系统要求是什么必须联网吗答Windows 7 x64或Linux x64均可运行。OCR引擎和语言库都打包在发行包里完全离线可用无需安装依赖。问识别出来的排版混乱或超大图片识别效果差怎么调答先更换排版解析方案比如改用单栏-按自然段换行。超大的长图要调高批量页设置→文字识别→限制图像边长的数值。另外图片分辨率越高识别效果越好。问识别结果到底存在哪里答三个去向截图页在识图后的操作里勾选复制结果后文字会进剪贴板批量页会把结果保存为设置里指定的txt、jsonl、md或csv文件命令行则用--output写文件、用--clip复制到剪贴板。如果你只需要一个把文字留在本地、不上传图片的识别工具Umi-OCR解压即用先跑一次批量识别再按自己的工作流调整输出格式。延伸阅读命令行手册、HTTP接口手册、更新日志。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表