
BIG TECH · CHINA
01阿里巴巴
Qwen / DAMO从统一 VLA、操作与导航执行器,延伸到具身大脑和自回归世界模型。
- 统一基座
- 任务分支
- 世界模型
不按单篇发布时间堆列表,而是把同一公司连续发布的模型整理成技术路线,快速看清它们如何从动作策略走向世界模型。

从统一 VLA、操作与导航执行器,延伸到具身大脑和自回归世界模型。

沿双系统 VLA、隐式世界建模与全模态世界模型,搭建 Physical AI 底座。

从规模化机器人 Transformer,到网络知识迁移,再到 Gemini 具身推理与控制。

从早期视频生成预训练研究出发,转向通用 VLA,再扩展到双臂灵巧手系统。

围绕流匹配动作专家持续演进:高频控制、开放世界、真机 RL 与可操控通才。

同时推进潜动作策略与视频世界平台,把策略、评估和仿真串成闭环。

从开放 VLA 到语义动作 tokenizer,形成离散监督与连续动作生成协同演进的路线。

让世界模型同时承担合成数据与强化学习环境,推动策略持续自改进。