PaddleOCR是一套开源的OCR文字识别工具,源码托管在GitHub上,使用者可以获取最新代码并自由修改。该项目面向需要快速搭建文字识别功能的开发者,提供了从模型训练到部署的完整链路。工具本身注重实用性和落地效果,适合在真实业务场景中直接引用或二次开发。

PaddleOCR的主线是一套功能完整且实用的OCR工具库,帮助使用者在自己的数据上训练出更准确的模型
项目内置了PP-OCR超轻量级识别系统,整个流程由文本检测、检测框方向矫正和文本识别三个环节组成
经过反复调优和瘦身,最终得到的中英文识别模型整体体积为3.5M,纯英文数字识别模型体积为2.8M
项目提供了多个系列的预训练模型,方便不同设备和使用场景直接调用
移动端系列(ppocr_mobile)面向手机等低算力设备,其中检测模型2.6M、方向分类器0.9M、识别模型4.6M,合计8.1M
服务端系列(ppocr_server)追求更高精度,检测模型47.2M、方向分类器0.9M、识别模型107M,合计155.1M
还有经过压缩的移动端系列(ppocr_mobile_slim),检测模型1.4M、方向分类器0.5M、识别模型1.6M,整体仅3.5M
支持中英文以及数字组合的文字识别,同时也能处理竖排文本和超长文本内容
允许使用者基于自有数据训练专属模型,并提供多种预测推理与部署方案,方便嵌入不同业务
支持通过pip快速安装,并可在Linux、Windows、MacOS等主流操作系统上运行
(您的评论需要经过审核才能显示)
0条评论