智元|发布AGILE2.0感控一体模型,强调边看边想边动

PromptTree|阅读 1
2026/09/12 08:16
智元机器人AGILE2.0感控一体人形机器人
智元发布AGILE2.0感控一体模型,强调视觉感知与全身运动端到端耦合,并以《杂技BOT》展示踩球、跳长绳、搬箱互助等动态任务。

人形机器人若只能在结构化场地「按脚本动」,一进开放扰动就会露馅。近窗,智元发布AGILE2.0感控一体模型(AGIBOT Generative Intelligent Locomotion Engine),公开定位是让机器人「边看边想边动」,并以创意短片《杂技BOT》呈现踩球行走、跳长绳、搬箱互助等任务。公司口径称,相关演示用于直观表达感控一体能力,并提及双足人形自主踩球等表述。

智元是国内人形与具身智能整机厂商,近窗刚公开过GE-Act 2.0等世界—动作模型方向的工作,侧重操作数据缩放与跨本体迁移。AGILE系列切口不同:把运动智能本身做成「看得到、想得到、动得稳」的闭环,服务灵犀X2等本体在动态环境中的全身控制与上下肢协同。对采购方来说,这回答的是另一道题——不是「会不会折毛巾」,而是「球在滚、绳在甩、旁边还有人时还敢不敢继续走」。

能力与场景要点(公司口径):

  1. 闭环:环境观测、地形理解、动态可通行性、全身控制、接触切换、末端精细操作耦合
  2. 形态:强调端到端、减少中间模块与人工阶段拆分
  3. 极限扰动:视觉闭环实时推理 + 动态约束优化
  4. 协同:双人/多人跨机器人状态感知与行为协同
  5. 安全:人员随机闯入时的防护与自主恢复
  6. 演示:《杂技BOT》踩球、跳长绳、搬箱互助等

所谓感控一体,白话是眼睛看到的变化要直接进全身控制,而不是感知模块与步态模块各自为政;所谓睁眼运动,白话是运动中持续用视觉修正可通行性与接触状态。相对AGILE 1.0「打通链路」,2.0叙事更强调全链路深度耦合与开放环境部署态。对具身赛道,它与世界模型、VLA操作模型形成互补:一边预演后果与操作技能,一边把高动态全身运动从遥控/脚本里解放出来。

放在产业化上下文里,展示短片能拉高注意力,验收却看连续工况故障率、安全围栏与可复现评测协议。竞品若只有高动态视频、给不出视觉闭环时延与恢复策略,很难写进产线或展厅值班合同;若只有静态操作精度、站不稳开放地面,同样过不了「能部署」门槛。

产业影响上,若AGILE2.0进入可评测、可下载或可对外集成的资产形态,会抬高「运动智能」在整机招标中的权重;若长期停在成片,市场会迅速回到节拍与良率。需要把边界读清楚:演示与「业内首次」属公司口径。下一观察点是评测协议是否公开,以及非剧本扰动下的恢复成功率。