概览
这场竞赛适合谁
适合已有 PaddleOCR / Python 模型开发经验、能训练和优化 OCR 或表格结构识别模型的团队。参赛者需在“OCR 端到端识别任务”和“通用表格识别任务”中任选其一;进入决赛的团队还需要能开源完整训练与推理代码、权重并进行线下答辩。
查看官方简介原文
PaddleOCR 旨在打造一套丰富、领先、且实用的 OCR 工具库,助力开发者训练出更好的模型,并应用落地。作为飞桨开源社区最热门的套件开源项目,PaddleOCR 拥有业界领先的 PP-OCR 模型和多场景通用的表格识别模型,广受众多开发者和用户的认可和使用。本次算法模型挑战赛聚焦通用 OCR 模型,要求开发者以当前飞桨开源模型为基线,不断突破技术瓶颈,研发出更加高效准确的新模型。 Official category: 实战竞技赛. Organizers: 百度时代网络技术(北京)有限公司. Participants: 199.
参赛准备
从报名到首次提交的准备步骤
- 01
PaddleOCR 框架
- 02
OCR 检测与识别模型
- 03
表格结构识别
- 04
Python 推理脚本
- 05
OpenVINO 推理优化
- 06
Git 与 AtomGit
投入前确认:难点不只是提高识别效果,而是在接近基线推理速度的约束下完成模型优化。表格赛题还要求应对复杂表格结构和不均衡数据分布,且评估中“错一个 Token 就算错误”;入围后还要满足代码、权重、数据来源和复现材料的开源要求。
来源