新手分
30/100
适合已有大语言模型应用或语音生成实践、希望用腾讯混元开源模型做 AI 播客原型的个人或团队。参赛者需要能在本地部署模型,并处理文本到多角色播客音频、角色人设与音色控制,以及主题内容生成;参赛对象不受限制。
如果下面这些前置项还很陌生,先补准备通常比直接参赛更划算。
本地开源模型部署
提示词工程
模型微调
多角色对话生成
TTS/语音合成
Python与代码仓库管理
真正的难点通常不是“会不会调包”,而是验证、时间分配和任务理解。
难点不只是生成一段语音,而是三个子题都必须完成:既要让多角色对话自然互动,又要把指定人设与音色稳定对应,还要生成有依据、有深度的主题内容。作品还须提交可复现的训练和推理代码、训练数据结果及技术报告,并接受自动化和专家对内容事实性、音质、交互与整体体验的综合评估。
以下竞赛与当前竞赛方向或难度相近,可以一起对比。
把已确认、待核对和人工审核状态分开看;最终规则与截止时间以官方页为准,发现错误欢迎提交纠错。
官方 metric 还没有从当前抓取结果中确认,仍需人工核对。
reward_value_usd is a rough CNY→USD estimate (×0.14) for ranking only; use reward_summary for the official prize text.