新手分
30/100
适合有大模型应用开发经验、能处理PDF学术文献的个人或小团队,尤其是做过RAG、多智能体流程或科研信息检索工具的人。参赛者还需要能将完整方案以可构建运行的代码仓库和设计文档交付。
如果下面这些前置项还很陌生,先补准备通常比直接参赛更划算。
检索增强生成(RAG)
多智能体编排
大模型微调
PDF文献解析
引文溯源
Docker镜像构建
真正的难点通常不是“会不会调包”,而是验证、时间分配和任务理解。
难点不只是生成长文,而是在约2万篇PDF文献中检索和综合大量证据,生成结构清晰的综述,并把具体声明落实到句子或段落级引用来源。系统还要兼顾引用召回与精确、内容质量和生成速度,并能由评审方从仓库构建Docker镜像后运行评测。
以下竞赛与当前竞赛方向或难度相近,可以一起对比。
把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准,发现错误欢迎提交纠错。
官方 metric 还没有从当前抓取结果中确认,仍需人工核对。
reward_value_usd is a rough CNY→USD estimate (×0.14) for ranking only; use reward_summary for the official prize text.