新手分
55/100
适合有中文自然语言处理和抽取式阅读理解经验的人,尤其是能从民航出行相关网页段落中定位答案文本跨度的参赛者。也适合能够处理一个问题对应多个、且分布在不同段落中的答案片段的开发者。
以下内容来自比赛官方页面。
Baseline model for participants to reference and improve
Technical discussion group for participant communication
Organiser staff regularly answer questions in the group
如果下面这些前置项还很陌生,先补准备通常比直接参赛更划算。
中文阅读理解建模
抽取式问答
文本跨度定位
多答案预测
JSON Lines 文件生成
F1 评估实现
真正的难点通常不是“会不会调包”,而是验证、时间分配和任务理解。
难点在于细粒度地输出原文中的连续答案片段,并准确给出其文章路径、字符位置和答案类型;部分问题还要求组合多个片段。评分会对预测片段与标注片段的重合度计算 F1,因此边界定位偏差会直接影响成绩。
以下竞赛与当前竞赛方向或难度相近,可以一起对比。
把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准,发现错误欢迎提交纠错。
官方 metric 还没有从当前抓取结果中确认,仍需人工核对。