↑

IROS 2026世界模型挑战赛WorldArena 2.0开考真机应用,中国团队表现突出

PromptTree|阅读 0
2026/10/11 07:08
IROSWorldArena世界模型具身智能清华大学
在IROS 2026会议期间,由清华大学团队联合多所海内外高校发起的WorldArena 2.0 Challenge完成新一届角逐,设视频、在线强化学习与真机三条赛道,检验世界模型能否被机器人真正用起来,JEPA与空间智能路线正面交锋,中国队伍视启未来、晨昏线科技取得优异成绩。

世界模型的研究热度常年居高不下,但「榜单分数高」与「机器人真能用」之间一直隔着一道沟。在机器人领域最具影响力的国际顶会之一IROS 2026期间,WorldArena 2.0 Challenge把这道沟变成了考场:这项由清华大学团队联合多所海内外高校发起的赛事,核心命题只有一个——世界模型能不能被机器人真正用起来。

与常见的离线评测不同,WorldArena 2.0设了三条赛道:视频赛道考察模型的视觉预测能力,在线强化学习赛道考察交互中的适应能力,而真机赛道则要求模型在真实机器人闭环中完成预测与规划。真机赛道的意义在于把仿真到现实(Sim2Real)的落差、推理延迟、失败恢复这些「论文里看不见」的因素全部计入成绩。参赛阵营中,JEPA路线与空间智能路线的模型在真机任务上正面交锋——前者强调在抽象表征空间中做预测,后者强调显式的空间理解,两条技术路线谁是真机的「优等生」,这届比赛给出了新的实证材料。

成绩方面,中国队伍表现突出:视启未来、晨昏线科技两支队伍取得优异成绩。对于以榜单见长的世界模型研究而言,中国团队在真机闭环赛项上的强势,是一个值得关注的信号——它说明国内具身智能的积累已经开始从数据与模型层面,延伸到真机部署与工程化层面。

把这届比赛放进IROS 2026的整体氛围里看,信号更加清晰。会议期间多方观察都指向同一个判断:具身智能的学术与产业边界正在消融,评价体系的重心从「离线基准分」转向「真机可用性」。世界模型要走向落地,光有预测精度不够,还要过得了延迟、稳定性与成本这三关。

对产业界而言,WorldArena这类真机赛事的价值在于提供了一个公共的、可比较的「落地标尺」。下届赛事的观察点有两个:真机赛道成绩与仿真成绩的差距是否收窄,以及头部分数模型能否在真实产线与家庭场景中复现表现。世界模型从论文走向机器人的最后一公里,正在被这样的比赛一段一段量出来。