新手分
78/100
适合已有图像文字识别(OCR)基础、想用 PaddlePaddle 训练端到端模型的个人开发者。参赛者需要能处理中国街景中截取出的文字行图像,并按要求生成预测结果和原始代码;比赛仅支持个人参赛。
以下内容来自比赛官方页面。
60,000 Chinese street-scene text images with CSV annotations
CSV annotation files with image dimensions, filenames, and text labels
如果下面这些前置项还很陌生,先补准备通常比直接参赛更划算。
能够读懂官方赛题与参赛规则
能够运行基础方案并完成一次有效提交
中文场景文字识别
图像文本预处理
端到端深度学习模型
TXT 制表符结果文件生成
真正的难点通常不是“会不会调包”,而是验证、时间分配和任务理解。
中文街景文字会受到光照变化、低分辨率、字体与排布多样、字符种类多等影响;而且评测只在整条文字行与标注完全匹配时才计为正确。训练还只能使用比赛提供的数据,不能引入其他开源数据集。
以下竞赛与当前竞赛方向或难度相近,可以一起对比。
把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准,发现错误欢迎提交纠错。
官方 metric 还没有从当前抓取结果中确认,仍需人工核对。