HyperDCM:用双曲动态聚类记忆实现跨场景持续机器人导航论文提出HyperDCM,把RGB观测转为场景图并映射到Poincaré双曲空间,再用结构敏感动态聚类维护回放样本,缓解扩散导航策略跨场景训练的灾难性遗忘。Zhengfei Lu, Jian Yang, Muyu Wang·2026年7月4日持续学习视觉导航扩散策略2026年7月4日
DeWorldSG:基于世界模型先验的深度感知3D语义场景图生成DeWorldSG从RGB-D序列生成时空鲁棒的3D语义场景图。通过深度引导滤波估计实例级几何3D高斯分布,将每个物体表示为概率3D节点而非单点投影;跨物体对聚合时空证据并用世界模型(V-JEPA 2)的上下文先验精炼关系。三元组召回率提升77.4%,谓词召回率提升23.2%。Seok-Young Kim, Abdelrahman Elskhawy, Taewook Ha·2026年7月1日场景图RGB-D 视觉V-JEPA 22026年7月1日
DAAAM:实时大规模4D场景理解的时空记忆框架DAAAM 是一个面向大规模实时4D场景理解的时空记忆框架。通过基于优化的前端从局部描述模型(DAM)推断详细语义描述,批量处理加速一个数量级;构建分层4D场景图,用于增强现实和大规模环境机器人自主导航。Nicolas Gorlo, Lukas Schmid, Luca Carlone·2025年11月29日spatio-temporalDAMMIT-SPARK2025年11月29日
SuperMap:面向视觉语言导航的时空SLAM系统SuperMap是CMU提出的实时4D时空语义建图框架,将高频几何SLAM与异步开放词汇感知结合,通过一致性驱动的建图引擎维护稳定的物体实例身份并在遮挡和场景变化下修剪过时内容,生成可查询的4D场景图接口供视觉语言模型进行零样本推理和语言引导导航。Shibo Zhao, Guofei Chen, Honghao Zhu·2026年7月1日同步定位与建图视觉语言导航场景图2026年7月1日