概览
这场竞赛适合谁
适合已有 GPU 算子开发和分布式推理优化经验的开发者,尤其是能处理单节点 8 GPU 全互连环境下 GEMM、ReduceScatter、AllGather 等算子的参赛者。中国大陆参赛者还需要能够通过官方 CLI 或 Discord 提交算子。
查看官方简介原文
参赛者将致力于开发和优化多GPU分布式推理算子,并在AMD GPU上实现LLM性能的重大提升。挑战赛于北美太平洋标准时间2025年8月23日开放注册,算子提交期从8月30日开始,至2025年10月13日结束。参赛者有资格赢取高达100,000美元的奖金,并有机会被邀请前往美国旧金山参加特别颁奖典礼。 Official category: 应用开发赛. Participants: 351. Organizers: AMD, 魔搭社区, Datawhale.
参赛准备
从报名到首次提交的准备步骤
- 01
GPU 算子开发
- 02
分布式推理
- 03
GEMM 优化
- 04
ReduceScatter 通信
- 05
AllGather 通信
- 06
CLI 或 Discord 提交
投入前确认:主要难点是为单节点 8 GPU 全互连场景实现并提交多类高性能算子,包括 GEMM 与集合通信组合算子;不同算子有各自的提交窗口,参赛流程也要求先补全报名信息。
来源