宇树科技|UnifoLM-X2-1.0实现世界模型实时驱动全自主人形搏击

PromptTree|阅读 2
2026/09/08 06:43
宇树科技UnifoLM-X2世界模型人形机器人
9月7日,宇树科技发布视频并披露UnifoLM-X2-1.0突破世界—动作大模型瞬时规划、决策与动态交互执行瓶颈,实现高动态条件下对未来的实时预测与规划,完成人形机器人全自主搏击,公司称验证世界模型驱动大规模落地的基础可行性。

人形机器人能不能进开放场景,关键往往不只是「会不会摆动作」,而是对手、接触力与未来半秒轨迹能不能实时预测并落地。9月7日,宇树科技发布视频并公开披露:UnifoLM-X2-1.0突破世界—动作大模型在瞬时规划、决策与动态交互执行上的瓶颈,实现高动态、强交互条件下对未来的实时预测与规划,完成人形机器人全自主搏击。公司口径称,这是全球首次世界模型实时驱动的全自主人形机器人格斗,并据此验证世界模型驱动人形机器人大规模落地部署的基础可行性。

宇树科技是科创板人形机器人与四足平台厂商,产品覆盖消费级与行业级本体,近期完成上市后持续用高动态任务证明「大脑」与本体闭环。相对固定工位搬运,搏击场景几乎没有「暂停键」:接触时刻不可回放,对手意图快速变化,平衡与落脚必须在毫秒级完成闭环。把世界模型与动作大模型绑在同一条实时链路上,等于把讨论从离线演示视频推进到「边预测边打」的在线控制。

能力与路径要点:

  1. 模型:UnifoLM-X2-1.0,定位世界—动作大模型
  2. 突破点:瞬时规划、决策、动态交互执行
  3. 工况:高动态、强交互,强调对未来的实时预测与规划
  4. 验收叙事:全自主搏击演示;验证世界模型驱动大规模落地的基础可行性(公司口径)
  5. 商业路径:中短期侧重科研、应用开发、教育教学、文化表演与智能服务;中长期面向工业、家庭与社会场景系统化服务

公开材料亦回顾具身泛化这一行业卡点:固定场景充分训练后任务成功率可以接近满分,一旦更换操作物品或环境则大幅下滑。世界机器人大会期间,公司曾把产业临界点描述为——用户把机器人带到任意陌生环境,仅通过语言或文字指令完成约八成日常任务;时间窗口被表述为快则约二至三年、慢则约五至十年。搏击演示赌的是另一条证明链:先在极端高动态对抗里证明实时预测—规划—执行闭环成立,再外推到产线与服务。

所谓全自主搏击,白话是现场不再靠人手遥操作一招一式,而是模型自己读态势、选动作、保平衡;所谓世界模型实时驱动,白话是先对未来短暂窗口做预测,再把预测写进当下动作,而不是事后剪出漂亮成片。对研发团队,验收标准从「动作库够不够炫」变成「接触扰动下还能不能连续决策」。

放在具身商业化上下文里,过去一年行业一边刷搬运、整理、巡检等准结构化任务,一边用格斗、田径、球类证明运动控制上限。世界模型路线若只停留在视频生成或离线规划,很难说服工厂采购方;实时闭环才是「能不能干活」的前置条件之一。竞品若只有遥操作高光或离线轨迹优化,对照标准会被抬高。

产业影响上,若同类高动态任务形成可复现评测协议,世界—动作栈可能成为人形交付的新默认模块;若长期停在演示视频,市场仍会追问连续工况成功率与安全围栏。需要把边界读清楚:「全球首次」属公司发布口径;演示验证不等于已具备开放公共空间无监管部署条件。下一观察点是对抗规则标准化、成功率统计公开方式,以及产线/服务场景能否复用同一套栈。