双主线研究地图
从 VLA 的动作生成,到 WAM 的世界预测,沿两条主线理解技术演进。
打开研究总览
> 从经典 VLA 到前沿 WAM,把论文谱系、硬数据与产业生态连成一张可检索的研究地图
VLA 的核心问题是:模型如何把视觉观察与语言指令,转化为可执行、可泛化的机器人动作。下面按“动作如何生成”拆成五条路线。
如何稳定生成高频、多峰连续动作?
如何兼顾语义规划与低层控制精度?
如何让慢推理与快速闭环协作?
如何从视频、真机反馈与记忆持续进化?
WAM 不只回答“下一步做什么”,还显式或隐式预测“做了之后世界会怎样”。下面按级联、联合与跨范式底座组织。
如何用统一因果序列建模未来与动作?
如何并行生成多模态未来与连续动作?
如何让规划与连续控制各取所长?
如何把世界建模变成可复用基础设施?