新手分
12/100
想在抽象推理 benchmark 上做研究、并且能接受 Kaggle 纯代码提交和长时间 CPU/GPU 运行的进阶选手和研究型团队。
以下内容来自比赛官方页面。
ARC-AGI training, evaluation, test challenge, solution, and sample submission files.
如果下面这些前置项还很陌生,先补准备通常比直接参赛更划算。
Python
Kaggle notebook 提交流程
程序合成或推理 benchmark 经验
严格的验证纪律
能运行长时间 CPU/GPU 实验
真正的难点通常不是“会不会调包”,而是验证、时间分配和任务理解。
ARC 类任务要求模型泛化到全新的推理模式,而不是拟合熟悉的训练分布。竞赛使用自定义评测、每天仅一次提交、超长运行时限,赛场上也以研究型选手为主。
以下竞赛与当前竞赛方向或难度相近,可以一起对比。
把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准,发现错误欢迎提交纠错。