PaddleOCR/README_ch.md

15 KiB
Raw Blame History

English | 简体中文

简介

PaddleOCR旨在打造一套丰富、领先、且实用的OCR工具库助力开发者训练出更好的模型并应用落地。

近期更新

  • 🔥2022.5.11~13 每晚830【超强OCR技术详解与产业应用实战】三日直播课

    • 11日开源最强OCR系统PP-OCRv3揭秘
    • 12日云边端全覆盖的PP-OCRv3训练部署实战
    • 13日OCR产业应用全流程拆解与实战

    赶紧扫码报名吧!

  • 🔥2022.5.9 发布PaddleOCR release/2.5
    • 发布PP-OCRv3速度可比情况下中文场景效果相比于PP-OCRv2再提升5%英文场景提升11%80语种多语言模型平均识别准确率提升5%以上;
    • 发布半自动标注工具PPOCRLabelv2:新增表格文字图像、图像关键信息抽取任务和不规则文字图像的标注功能;
    • 发布OCR产业落地工具集打通22种训练部署软硬件环境与方式覆盖企业90%的训练部署环境需求;
    • 发布交互式OCR开源电子书《动手学OCR》覆盖OCR全栈技术的前沿理论与代码实践并配套教学视频。
  • 2021.12.21 发布PaddleOCR release/2.4
    • OCR算法新增1种文本检测算法PSENet3种文本识别算法NRTRSEEDSAR
    • 文档结构化算法新增1种关键信息提取算法SDMGR3种DocVQA算法LayoutLM、LayoutLMv2LayoutXLM
  • 2021.9.7 发布PaddleOCR release/2.3
    • 发布PP-OCRv2CPU推理速度相比于PP-OCR server提升220%效果相比于PP-OCR mobile 提升7%。
  • 2021.8.3 发布PaddleOCR release/2.2
    • 发布文档结构分析PP-Structure工具包支持版面分析与表格识别含Excel导出

更多

特性

支持多种OCR相关前沿算法在此基础上打造产业级特色模型PP-OCRPP-Structure,并打通数据生产、模型训练、压缩、预测部署全流程。

上述内容的使用方法建议从文档教程中的快速开始体验

快速开始

《动手学OCR》电子书

场景应用

  • PaddleOCR场景应用覆盖通用制造、金融、交通行业的主要OCR垂类应用在PP-OCR、PP-Structure的通用能力基础之上以notebook的形式展示利用场景数据微调、模型优化方法、数据增广等内容为开发者快速落地OCR应用提供示范与启发。详情可查看README

开源社区

  • 加入社区👬 微信扫描二维码并填写问卷之后,加入交流群领取福利

    • 获取5月11-13日每晚20:30《OCR超强技术详解与产业应用实战》的直播课链接
    • 10G重磅OCR学习大礼包《动手学OCR》电子书配套讲解视频和notebook项目66篇OCR相关顶会前沿论文打包放送包括CVPR、AAAI、IJCAI、ICCV等PaddleOCR历次发版直播课视频OCR社区优秀开发者项目分享视频。
  • 社区贡献🏅社区贡献文档中包含了社区用户使用PaddleOCR开发的各种工具、应用以及为PaddleOCR贡献的功能、优化的文档与代码等,是官方为社区开发者打造的荣誉墙,也是帮助优质项目宣传的广播站。

  • 社区常规赛🎁社区常规赛是面向OCR开发者的积分赛事覆盖文档、代码、模型和应用四大类型以季度为单位评选并发放奖励赛题详情与报名方法可参考链接

PP-OCR系列模型列表更新中

模型简介 模型名称 推荐场景 检测模型 方向分类器 识别模型
中英文超轻量PP-OCRv3模型16.2M ch_PP-OCRv3_xx 移动端&服务器端 推理模型 / 训练模型 推理模型 / 训练模型 推理模型 / 训练模型
英文超轻量PP-OCRv3模型13.4M en_PP-OCRv3_xx 移动端&服务器端 推理模型 / 训练模型 推理模型 / 训练模型 推理模型 / 训练模型
中英文超轻量PP-OCRv2模型13.0M ch_PP-OCRv2_xx 移动端&服务器端 推理模型 / 训练模型 推理模型 / 预训练模型 推理模型 / 训练模型
中英文超轻量PP-OCR mobile模型9.4M ch_ppocr_mobile_v2.0_xx 移动端&服务器端 推理模型 / 预训练模型 推理模型 / 预训练模型 推理模型 / 预训练模型
中英文通用PP-OCR server模型143.4M ch_ppocr_server_v2.0_xx 服务器端 推理模型 / 预训练模型 推理模型 / 预训练模型 推理模型 / 预训练模型

更多模型下载(包括多语言),可以参考PP-OCR 系列模型下载,文档分析相关模型参考PP-Structure 系列模型下载

文档教程

效果展示 more

PP-OCRv3 中文模型
PP-OCRv3 英文模型
PP-OCRv3 多语言模型
PP-Structure 文档分析
  • 版面分析+表格识别
  • SER语义实体识别
  • RE关系提取

许可证书

本项目的发布受Apache 2.0 license许可认证。