新手分
48/100
适合已经做过大语言模型指令微调、能在华为昇腾环境中使用MindSpeed-LLM的开发者或研究团队。参赛者还需要能准备合规的开源指令数据,并交付可运行代码、训练日志和微调后的模型文件。
如果下面这些前置项还很陌生,先补准备通常比直接参赛更划算。
能够读懂官方赛题与参赛规则
昇腾芯片训练环境
Llama2-7B全参数微调
分布式并行策略
指令数据集构建
MMLU评估
真正的难点通常不是“会不会调包”,而是验证、时间分配和任务理解。
难点在于同时优化全参SFT的训练吞吐和模型效果:既要通过并行策略、算子或算法优化提高样本处理速度,又要兼顾MMLU与多轮对话表现。提交不仅是结果,还需提供数据集链接、完整流程文档、可跑通代码、日志和模型检查点,并保证作品可脱离原开发环境运行。
以下竞赛与当前竞赛方向或难度相近,可以一起对比。
把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准,发现错误欢迎提交纠错。
官方 metric 还没有从当前抓取结果中确认,仍需人工核对。
reward_value_usd is a rough CNY→USD estimate (×0.14) for ranking only; use reward_summary for the official prize text.