DECOWAM:面向腿式移动操作的解耦全身世界-动作模型DECOWAM 在冻结的 FastWAM 视频-动作主干上,通过未来等价瓶颈、底盘/手臂因子化与自我运动条件三个解耦接口建模腿式移动操作,Stage-2 可训练参数减少 232 倍,真机任务成功率 58.2%。Siyuan Ma, Boshi Zhang, Yutian Zhang·2026年8月20日视觉语言动作模型世界模型世界动作模型2026年8月20日
SimWAM:端到端自动驾驶的简单世界-动作模型提出将视频生成仅作为训练信号的简洁世界-动作模型,联合训练视频专家和轻量动作专家,用隔离注意力掩码使动作预测独立于未来帧,训练后丢弃视频分支保留自包含规划器直接预测轨迹,并用强化学习优化组合驾驶奖励,在 NAVSIM 上达 91.5 PDMS。Zongchuang Zhao, Xin Zhou, Tianyang Xu·2026年8月7日NAVSIMSimWAM世界动作模型2026年8月7日
ω-0:人形机器人协同移动操作的潜空间预测世界动作模型提出ω-0,面向真实人形机器人协同移动操作的全身世界动作模型:给定语言指令、视觉观测与本体状态,直接预测控制器可执行的全身动作潜变量;以轻量未来观测嵌入预测替代视频重建,耦合潜空间视觉预见与扩散式全身动作生成;并采集40+小时真机数据集ω-HOME,在11项家庭任务上稳定超越IL/VLA/人形/WAM基线。Zhe Li, Zhenzhe Zhang, Yangyang Wei·2026年8月6日世界动作模型人形机器人移动操作2026年8月6日
Robust-WAM:桥接世界-动作模型的生成式预训练与语义前瞻提出视频生成式世界-动作模型的通用后训练方法,保留 VAE 潜空间的生成路径并添加轻量语义前瞻对齐目标,用可学习查询 token 将未来场景语义引入动作流,使动作基于外观不变的动态表示,在 OOD 泛化仿真和真机上持续提升多种 WAM 基线成功率。Haodong Yan, Junfeng Li, Junjie He·2026年8月6日VAERobust-WAM世界模型2026年8月6日