概览
这场竞赛适合谁
希望参加真实平台竞赛,并能阅读规则、运行基础方案和完成提交的学习者。
查看官方简介原文
在现实世界中,信息往往以多模态的形式呈现,尤其是图像与文本的结合。例如,包含图示的教科书、带图解的说明书、信息图表、科学论文、新闻报道,甚至是社交媒体帖子,都要求我们不仅能理解单独的图片或文字,更要将两者结合起来进行深层次的逻辑推理。当前的AI模型在处理单一模态(如纯文本阅读理解或纯图像识别)方面已取得显著进展,但在需要跨模态、多步骤、甚至涉及常识知识… Official track: 多模态技术. Sponsor: 科大讯飞xDatawhale. Teams entered: 48.
参赛准备
从报名到首次提交的准备步骤
- 01
能够阅读中文竞赛规则
- 02
能够运行并提交一个基础方案
- 03
能够运行基础方案并完成一次有效提交
投入前确认:真正的难点在于理解官方赛题、确认参赛资格,并在有限时间内完成验证和提交。
来源