ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

PaddleOCR 营业执照识别实测:3 行代码跑通,模型怎么选看这张表

PaddleOCR 营业执照识别实测:3 行代码跑通,模型怎么选看这张表 PaddleOCR 营业执照识别实测3 行代码跑通模型怎么选看这张表【免费下载链接】PaddleOCRTurn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100 languages.项目地址: https://gitcode.com/GitHub_Trending/pa/PaddleOCR营业执照上的企业名称、信用代码、法人等十几项字段人工逐条抄录容易错漏。用 PaddleOCR 可以换成一次predict()调用默认 PP-OCRv5 服务端识别准确率 86.38%输出带坐标的结构化文本直接入库或喂给 LLM。 原理拆解PaddleOCR 营业执照识别的 5 步技术链路一张证照从图片变成可查询的数据走的是一条固定流水线方向分类先过文本行方向分类器PP-LCNet准确率 99.42%把拍反 180° 的页面翻正。白话先确认字是正着还是倒着。文本检测检测模型给每段文字画框默认 PP-OCRv5_server_det 的检测 Hmean 为 83.8%。文本识别逐个裁剪文字区域识别模型输出字符和置信度。版面分析换用 PP-StructureV3 产线后表格、印章、段落被分别标记并给出坐标印章不再和正文混在一起。结构化输出结果以 JSON / Markdown 形式给出文本、置信度、框坐标齐全。 快速上手PaddleOCR 最小可运行示例第一步只解决环境装没装对的问题装完框架和工具包即可pip install paddlepaddle pip install paddleocr第二步解决第一张证照怎么跑下面是最小可运行示例替换成你自己的图片路径就能出结果from paddleocr import PaddleOCR ocr PaddleOCR() # 默认加载 PP-OCRv5 检测识别服务端模型 result ocr.predict(business_license.jpg) # 传入路径列表可做批量识别 for res in result: res.print() # 打印每行文本与置信度 res.save_to_img(out) # 导出带文字框的可视化图片跑完res.print()会列出每行文本和置信度res.json直接拿到文本、分数与多边形坐标的 JSON。需要表格结构、单元格坐标时把产线换成PPStructureV3即可。 模型选择对比表PP-OCRv5 检测与识别模型怎么选以下数据取自项目文档按精度换体积的思路选模型精度体积适用场景PP-OCRv5_server_rec默认识别 86.38%81 MB服务端证照录入首选PP-OCRv5_mobile_rec识别 81.29%16 MB端侧 / 移动端PP-OCRv5_server_det默认检测 83.8%84.3 MB服务端文字定位PP-OCRv5_mobile_det检测 79.0%4.7 MB端侧文字定位默认推荐什么都不改直接用 server 版检测 识别组合精度最高只有要部署到手机或边缘盒子时才换 mobile 版。如果用的是 PaddleOCR 3.7.0 及以上可关注 PP-OCRv6 的 tiny/small/medium 三档medium34.5M 参数较 PP-OCRv5 检测提升 4.6%、识别提升 5.1%CPU 推理在 OpenVINO 下提速 5.2 倍。⚠️ 避坑经验实测证照识别的 4 个高频问题倒页识别乱码实测拍反的证照输出全是乱字。原因是 180° 页面没被纠正。处理默认产线已内置文本行方向分类PP-LCNet_x1_099.42%保持开启即可别手动砍掉这一步。红章压字漏检印章下的字符置信度明显偏低。原因是红色印章干扰了识别模型。处理改用 PP-StructureV3 做版面分析把印章单独框出项目还内置了独立的印章识别产线。mobile 模型精度掉 5 个点同一张图 mobile 版 81.29%、server 版 86.38%。原因是 mobile 模型只压缩到 16 MB体积换精度。处理录入类业务固定用 server 版端上预览再用 mobile 版。纯 CPU 跑得太慢默认 PaddlePaddle 后端在 CPU 上吞吐有限。原因是没启用加速后端。处理切到 OpenVINO / ONNX Runtime 高性能推理官方数据 CPU 提速 5.2 倍、Apple M4tiny 档6.1 倍方法见 高性能推理与 benchmark 文档。默认 server 模型跑通识别需要版面坐标和表格结构时换 PP-StructureV3这两步能覆盖绝大多数证照录入需求。完整参数与产线说明见 OCR 产线文档核心实现在 paddleocr/ 目录。【免费下载链接】PaddleOCRTurn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100 languages.项目地址: https://gitcode.com/GitHub_Trending/pa/PaddleOCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表