新手分
55/100
适合已有中文机器阅读理解经验、能使用 PaddlePaddle 2.0 及以上版本训练端到端模型的个人参赛者。尤其适合希望学习模型可解释性,并能处理答案抽取与 token 级证据输出的人。
官方提供了可以直接运行的基线,从它开始通常比从零搭快得多。
Evaluation dataset with 4,366 examples, rationales, and perturbations.
如果下面这些前置项还很陌生,先补准备通常比直接参赛更划算。
能够读懂官方赛题与参赛规则
机器阅读理解
中文文本分词与 token 对齐
证据抽取(rationale)
TrustAI 解释方法
TSV/ZIP 提交文件生成
真正的难点通常不是“会不会调包”,而是验证、时间分配和任务理解。
难点不只是答对阅读理解答案,还要从给定的 sent_token 中按重要度顺序输出支持答案的 token id 序列;证据既要贴近人工标注,也要在扰动样本下保持一致。提交还必须同时满足指定的三列文本格式和 ZIP 文件命名要求。
以下竞赛与当前竞赛方向或难度相近,可以一起对比。
把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准,发现错误欢迎提交纠错。
官方 metric 还没有从当前抓取结果中确认,仍需人工核对。