像机器人一样看:面向VLA模型的机器人中心点图本文通过引入机器人中心点图(pointmap)解决VLA模型中相机帧观测与机器人帧动作之间的坐标系不匹配问题。点图的像素存储场景点在机器人坐标系下的3D坐标,在保留图像结构的同时提供机器人帧3D几何,使策略能跨不同相机设置泛化。Byungkun Lee, Dongyoon Hwang, Dongjin Kim·2026年7月13日视觉语言动作模型Pointmapcross-viewpoint2026年7月13日
DAAAM:实时大规模4D场景理解的时空记忆框架DAAAM 是一个面向大规模实时4D场景理解的时空记忆框架。通过基于优化的前端从局部描述模型(DAM)推断详细语义描述,批量处理加速一个数量级;构建分层4D场景图,用于增强现实和大规模环境机器人自主导航。Nicolas Gorlo, Lukas Schmid, Luca Carlone·2025年11月29日spatio-temporalDAMMIT-SPARK2025年11月29日