新手分
48/100
适合已有大语言模型微调和代码数据处理经验的学生、工程师或个人开发者团队。参赛者需要能够围绕代码补全准备训练数据、训练 CodeLlama-7B,并提交可复现的数据处理脚本、数据集和源代码材料。
如果下面这些前置项还很陌生,先补准备通常比直接参赛更划算。
CodeLlama-7B 微调
代码补全数据构建
训练数据清洗与处理
Python 与深度学习训练脚本
JSON 结果文件生成
模型训练可复现文档编写
真正的难点通常不是“会不会调包”,而是验证、时间分配和任务理解。
核心难点是自行根据少量样例准备并优化代码补全训练数据,同时让微调效果可复现;仅提交预测结果不够,还需交付数据处理脚本、受限规模的数据集、原理说明和模型优化文档。初赛还要求将生成结果转换为指定格式的 JSON 文件,并可能被随机抽测复现。
以下竞赛与当前竞赛方向或难度相近,可以一起对比。
把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准,发现错误欢迎提交纠错。
官方 metric 还没有从当前抓取结果中确认,仍需人工核对。
reward_value_usd is a rough CNY→USD estimate (×0.14) for ranking only; use reward_summary for the official prize text.