概览
这场竞赛适合谁
适合已有图像文字识别(OCR)基础、想用 PaddlePaddle 训练端到端模型的个人开发者。参赛者需要能处理中国街景中截取出的文字行图像,并按要求生成预测结果和原始代码;比赛仅支持个人参赛。
查看官方简介原文
中文场景文字识别技术在日常生活中具有丰富的应用场景。本次比赛以中文场景文字识别为主题,提供轻量级的中文场景文字识别数据,要求选手使用飞桨框架,对图像区域中的文字行进行预测,并返回文字行的内容。 Official tags: 中文OCR. Sign-ups: 591.
参赛准备
从报名到首次提交的准备步骤
- 01
能够读懂官方赛题与参赛规则
- 02
能够运行基础方案并完成一次有效提交
- 03
中文场景文字识别
- 04
图像文本预处理
- 05
端到端深度学习模型
- 06
TXT 制表符结果文件生成
投入前确认:中文街景文字会受到光照变化、低分辨率、字体与排布多样、字符种类多等影响;而且评测只在整条文字行与标注完全匹配时才计为正确。训练还只能使用比赛提供的数据,不能引入其他开源数据集。
来源