HyperDCM:用双曲动态聚类记忆实现跨场景持续机器人导航论文提出HyperDCM,把RGB观测转为场景图并映射到Poincaré双曲空间,再用结构敏感动态聚类维护回放样本,缓解扩散导航策略跨场景训练的灾难性遗忘。Zhengfei Lu, Jian Yang, Muyu Wang·2026年7月4日持续学习视觉导航扩散策略2026年7月4日
0:07Stanford 与 TRI 发现机器人持续学习中的关键 Memory Anchors@techniahqrobot · 108次播放 · 2026-08-28持续学习Memory Anchors机器人学习
Extreme-RGMT:面向鲁棒通用人形控制的高动态技能持续学习Extreme-RGMT提出持续学习方法用于人形机器人的高动态技能获取,实现对通用机器人控制的鲁棒泛化。Yubiao Ma, Han Yu, Kai Guo·2026年7月22日人形机器人持续学习运动控制2026年7月22日
世界模型记得,演员遗忘:用于持续基于模型强化学习的梦境复演DreamerV3系列基于模型的强化学习智能体在任务序列训练时灾难性遗忘,即使无限回放缓冲区保存了所有早期经验。本文研究持续RL文献假设但从未测量的问题:哪个组件遗忘最严重?提出梦境复演方法。Gurp Nijjer·2026年7月22日Dreamer世界模型持续学习2026年7月22日