新手分
48/100
适合能处理中文技术博客文本、构建多标签分类系统的高校学生、个人开发者或企业开发者;个人或2—5人团队均可参加。尤其适合已有NLP或本地部署小型大语言模型经验,并能提交完整可复现代码与模型文件的人。
如果下面这些前置项还很陌生,先补准备通常比直接参赛更划算。
中文技术文本处理
多标签文本分类
NLP模型训练
大语言模型本地推理
CSV/XLSX文件处理
Python代码复现与打包
真正的难点通常不是“会不会调包”,而是验证、时间分配和任务理解。
核心难点是在约300多个限定IT标签中为博文做精准多标签匹配,并兼顾未公开博文数据上的F1表现。提交还必须能以指定表格为输入、产出严格格式的CSV/XLSX,并提供完整执行步骤;使用大语言模型时只能使用10B以下模型,不能调用云端API。
以下竞赛与当前竞赛方向或难度相近,可以一起对比。
把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准,发现错误欢迎提交纠错。
官方 metric 还没有从当前抓取结果中确认,仍需人工核对。
reward_value_usd is a rough CNY→USD estimate (×0.14) for ranking only; use reward_summary for the official prize text.