Tavondo
竞赛活动指南平台
English开始匹配
竞赛活动指南平台
English登录
Tavondo

发现值得投入的 AI 竞赛与活动。

竞赛活动指南平台
登录注册开始匹配

© 2026 Tavondo

English
  1. 首页
  2. 竞赛
  3. FlagEval大模型角斗场评测大赛
Baidu AI Studio大语言模型入门报名状态待确认

FlagEval大模型角斗场评测大赛

一场入门难度的大语言模型竞赛,预计投入 4–12 小时,适合用真实赛题完成一次端到端练习。

难度
入门
预计投入
4–12 小时
报名截止
待官方确认
算力
免费 GPU 可用
概览参赛准备来源

概览

这场竞赛适合谁

适合愿意以人工方式比较大模型回答质量的个人参与者,尤其是会编写 Prompt、能判断文本、图文理解或生成内容是否符合自己意图的人。比赛仅支持个人参赛;可按兴趣选择纯文本、图文理解、文生图或文生视频对战。

查看官方简介原文
FlagEval大模型角斗场评测大赛以智源研究院FlagEval天秤平台提供的大模型评测能力为基础,为用户提供一个直观、便捷的大模型能力体验的环境。 Official tags: 大模型评测. Sign-ups: 724.

参赛准备

从报名到首次提交的准备步骤

  1. 01

    提示词设计

  2. 02

    大模型输出评估

  3. 03

    文本生成质量判断

  4. 04

    图文理解结果判断

  5. 05

    文生图结果判断

  6. 06

    人工标注规范

投入前确认:核心难点是持续做出可靠且高质量的人工标注:排名不仅看评测量,还综合标注有效抽样得分、内容得分和正确率。每轮需等至少一个模型完整回复后投票,且不能用脚本、不能诱导模型透露身份;投票后也不能修改。

来源

本页信息如何得到

赛题信息由官方页面抓取后结构化整理,评分为平台估算,仅用于辅助判断,最终规则以官方页面为准。

官方赛事页
Baidu AI Studio
最后核对
未记录

参赛判断

est.
78

值得加入候选

综合适配度评分

新手适配度78/100
学习价值72/100

先确认资格和时间投入,再决定是否进入正式准备。

参赛资格待官方确认

打开官方页面登录后保存去看指南

数据与审核状态

把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准。

查看数据状态收起
来源页面已核验Metric 已确认已审核
本站纳入时间
2026年7月21日

官方 metric 还没有从当前抓取结果中确认,仍需人工核对。