
BeyondRetarget:从单目视频直接学习可执行人形运动
南京大学团队提出 BeyondRetarget,绕过 SMPL 人体中间表征,端到端将单目 RGB 视频直接映射为人形机器人可执行全身运动:18 个语义关键点 + 逐链接非均匀缩放构建统一监督,共享运动表征可解码至 8 种人形本体,配合接触感知修正,G1 上关键点误差压至 26.4mm、零崩塌,延迟 193ms 支持实时视觉遥操作。
Tianyu Xiong, Yi Lu, Jinrui Wang2026年9月24日
人形机器人运动重定向模仿学习2026年9月24日