6.3 KiB
6.3 KiB
comments | typora-copy-images-to | hide | ||
---|---|---|---|---|
true | images |
|
简介
PaddleOCR 旨在打造一套丰富、领先、且实用的 OCR 工具库,助力开发者训练出更好的模型,并应用落地。
🚀 社区
PaddleOCR 由 PMC 监督。Issues 和 PRs 将在尽力的基础上进行审查。欲了解 PaddlePaddle 社区的完整概况,请访问 community。
⚠️注意:Issues模块仅用来报告程序🐞Bug,其余提问请移步Discussions模块提问。如所提Issue不是Bug,会被移到Discussions模块,敬请谅解。
📣 近期更新
-
🔥2024.10.1 发布PaddleOCR release/2.9:
-
飞桨一站式全流程开发工具PaddleX,依托于PaddleOCR的先进技术,支持了OCR领域的一站式全流程开发能力:
-
支持文档场景信息抽取v3(PP-ChatOCRv3)、基于RT-DETR和PicoDet的高精度版面区域检测模型、高精度表格结构识别模型SLANet_Plus、版面矫正预测模型UVDoc、公式识别模型LatexOCR、基于PP-LCNet的文档图像方向分类模型
-
-
🔥2024.7 添加 PaddleOCR 算法模型挑战赛冠军方案:
- 赛题一:OCR 端到端识别任务冠军方案——场景文本识别算法-SVTRv2;
- 赛题二:通用表格识别任务冠军方案——表格识别算法-SLANet-LCNetV2。
🌟 特性
支持多种 OCR 相关前沿算法,在此基础上打造产业级特色模型PP-、PP-Structure和PP-ChatOCR,并打通数据生产、模型训练、压缩、预测部署全流程。

效果展示
超轻量PP-OCRv3效果展示
PP-OCRv3中文模型




PP-OCRv3英文数字模型



PP-OCRv3多语言模型


PP-Structure 文档分析
-
版面分析+表格识别
-
SER(语义实体识别)
-
RE(关系提取)
许可证书
本项目的发布受Apache 2.0 license许可认证。