EgoWAM:用第一视角人类数据训练机器人

视频加载中
视频加载中佐治亚理工 CoRL 2026:把世界模型的预测目标从像素换成 DINO 语义与 3D 运动流,机器人策略才真正吃下海量第一视角人类数据——OOD 泛化最高提升 4 倍,域内提升 20-30%。
世界动作模型机器人操控Egocentric VideoHuman-Robot Co-trainingDINO3D Motion FlowBehavior CloningBimanual ManipulationGeorgia TechCoRL具身智能
Category: arm
Author: @BaoyuLi6
Date: 2026-07-08T00:00:00
Duration: 63.93s
Reference: https://arxiv.org/abs/2607.08436





