ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Umi-OCR 命令行批量处理完整指南:从快速上手到自动化集成

Umi-OCR 命令行批量处理完整指南:从快速上手到自动化集成 Umi-OCR 命令行批量处理完整指南从快速上手到自动化集成【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款开源、免费、完全离线的 OCR 软件内置多国语言库支持截屏识别、批量导入图片与 PDF 文档处理。当面对成百上千张图片或需要把识别流程嵌入脚本与定时任务时反复点击图形界面便显得低效。此时Umi-OCR 命令行批量处理功能提供了一条更直接的路径一条指令即可完成整批文件的识别、结果输出与后续自动化。 快速起步3个最常用的命令行指令命令行入口是主程序Umi-OCR.exe备用启动器如RUN_GUI.bat可能不支持命令行。运行前需在全局设置中允许 HTTP 服务主机选择仅本地——命令行通过系统内部回环与后台进程通信数据不会经过物理网卡。指令一识别整个文件夹umi-ocr --path D:/scans程序会递归搜索该文件夹内所有图片含嵌套子目录逐张识别并输出结果。指令二同时传入多个文件与目录umi-ocr --path D:/img1.png D:/img2.png D:/image/test每个路径用双引号包裹路径之间以空格分隔支持图片与文件夹混合传入。指令三截屏识别并复制到剪贴板umi-ocr --screenshot --clip鼠标划选屏幕区域完成识别文本自动写入剪贴板无需离开当前窗口即可取用。结果默认显示在软件结果区配合--output参数可写入文件方便后续处理。 参数详解常用配置项速查表参数含义示例值默认值--path指定图片或文件夹可多个--path D:/img D:/a.png无--clip识别结果复制到剪贴板--screenshot --clip关闭--output结果写入文件覆盖--output result.txt无--output_append结果追加写入文件--output_append log.txt无--screenshot截屏识别可指定屏幕与区域--screenshot screen0 rect50,100,300,200鼠标划选--clipboard识别剪贴板中的图片--clipboard无--reload重新加载配置文件.settingsv2.1.5umi-ocr --reload无--show/--hide/--quit显示、隐藏主窗口或退出软件umi-ocr --hide无--qrcode_read/--qrcode_create识别或生成二维码umi-ocr --qrcode_create 内容 out.jpeg 128无提示所有指令支持以首几个字母简写如--screenshot可写为--sc多图识别耗时较长应在一条命令结束前不要输入下一条指令。实战流程从安装到批量出结果第1步安装与启动。下载程序并双击运行Umi-OCR.exe。命令行指令依赖主程序进程请确认后台已启动。第2步开启本地通信。在全局设置页中允许 HTTP 服务并保持仅本地模式这是命令行正常工作的前提。第3步配置识别参数。命令行任务的语言库、是否复制到剪贴板、是否弹出主窗口等参数沿用截图OCR标签页的设定。建议先在该页选定语言库并关闭识别后弹出主窗口让批量任务保持安静运行。第4步执行批量识别。umi-ocr --path D:/scans --output D:/result.txt第5步查看结果。处理过程中软件的批量OCR页面会实时显示进度、文件名与耗时与界面操作时的体验一致便于中途监控。 自动化与集成脚本、定时任务与HTTP调用批处理脚本。将指令写入.bat文件即可复用到任意目录umi-ocr --path D:/inbox --output_append D:/archive.txt定时任务。使用 Windows 任务计划程序设定每天固定时刻运行上述脚本即可实现无人值守的文档采集与归档。程序化调用。注意受运行环境限制Umi-OCR 无法支持系统重定向符与管道|。若需要在程序内发起调用并获取回传应改用 HTTP 命令行接口向http://127.0.0.1:1224/argv发送 POST 请求JSON 列表即等价于命令行参数。批量文档识别如 PDF同样可通过/api/doc系列接口完成上传、轮询、下载的全流程官方文档附有 Python 与 Web 示例代码。⚠ 问题速查问题原因解决办法输入命令没有反应使用备用启动器启动或 HTTP 服务被关闭改用主程序Umi-OCR.exe在全局设置中允许 HTTP 服务结果没有写入指定文件误用系统重定向符、\|改用--output或--output_append参数脚本收不到识别返回值命令行默认异步执行无法回传改用 HTTP 接口/argv同步调用连续识别时提示操作频繁上一条命令未结束就发起新指令等待当前任务完成后再输入下一条 进阶建议热更新配置。直接编辑UmiOCR-data/.settings配置文件后执行umi-ocr --reload即可刷新设置无需重启软件适合脚本动态调整参数。快捷键范围截图。将范围截图指令与热键工具 HotkeysCMD 绑定例如按下F10即截取指定区域并识别进一步提高桌面场景效率。开发者扩展。高级指令--call_py、--call_qml可调用任意标签页模块上的函数实现超越内置参数的定制行为需阅读源码了解函数签名。完整命令参考见官方文档docs/README_CLI.mdHTTP 接口说明见 docs/http/README.md。把批量识别的固定流程交给命令行之后你只需维护一批脚本剩下的时间可以留给真正需要人工判断的工作。不妨从第一条umi-ocr --path指令开始感受无人值守带来的效率变化。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表