机器人厂商各训各的大脑,数据就不互通。蚂蚁灵波发布的LingBot-VLA 2.0,把这件事写成“一脑多机”。
蚂蚁灵波做具身智能,VLA可以理解成把看见、听懂指令和动手串在一个模型里。相对上一代,这版在自由度支持、跨域操作和长程任务上做了升级。发布时点对着世界人工智能大会,会期是7月17日至20日。
这版公开的三点:
过去的绑定关系很直:大脑跟本体走,每家都要自研一套。结果是数据不能换着用,模型不能复用,训练成本下不来。一脑多机如果走通,上层仍可以做不同的身体,底层不必每家从零开始。原文用的类比是手机上的Android:系统统一,硬件仍然各做各的。
自由度要分开看。头部、腰部、手和移动底盘都在支持范围内,说明面对的不是一种固定关节的机器人。少训一遍大脑,省的是数据采集和重复训练,不是把本体硬件成本消掉。GM-100的领先写在跨域和长程移动操作上,陌生环境、复合任务的适应被写成明显优势。开源之后,效果好不好会由模型之外的人微调验证。
同一窗口里,智元、银河通用、星动纪元、自变量、墨奇也在准备发布。7月因此被写成具身智能的密集发布期。灵波选择此时开源,是在大会前先把“可下载的大脑”放到桌上,而不是只带一台会表演的机器人。
评测领先不等于已经能进工厂值班。GM-100是跨域任务的成绩,不是某条产线的开工率。17家厂商、20种构型,说明覆盖面写进了发布,不说明每家都已完成同等规模部署。
下一步看两件事:开源权重被第三方微调后,跨构型是否还稳;以及大会期间其他本体厂商是接这套大脑,还是继续各训各的。