人类做一件事之前,
脑子里会先过一遍"这样做会怎样"
机器人一直做不到这件事
它只能执行动作,不会预判结果
阿里DAMO院这个项目
把VLA模型和世界模型合进了同一个框架——
机器人不只是"看图然后动手"
而是先在脑子里模拟"我这样动之后画面会变成什么",
确认预期对了再执行
LIBERO基准任务成功率97.4%,
比单独跑VLA模型的方案明显高
1.1k星,代码全开源,Apache 2.0
👉
你觉得"先想象再执行"这件事,对机器人来说有多重要?
#
具身智能# #
世界模型# #
开源AI#