使用选择性对抗运动先验的多步态人形机器人学习在统一强化学习框架中为人形机器人学习多样化运动技能仍具挑战性,因为不同步态间稳定性和动态表达性的冲突需求。本文提出多步态学习方法,使人形机器人掌握五种不同步态——行走、正步、跑步、爬楼梯和跳跃——使用选择性对抗运动先验。Yuanye Wu, Keyi Wang, Linqi Ye·2026年4月21日人形机器人多步态强化学习2026年4月21日