← 标签
#具身AI (23)
EchoWM:可驾驶的世界模型,不只是看的片段
世界模型World ModelEchoWMJoy-Echo6DoF
Roblox推出自己的世界模型
世界模型RobloxControlNet预测模型具身AI
Ego2Robot:第一人称视频转训练数据
VLAEgo2Robot数据管线Qwen-RobotManip具身AI
Noetix E1运动控制升级
人形机器人Noetix E1运动控制敏捷移动具身AI
X-NavDP扩散导航策略
导航navigation扩散策略diffusion policy导航基础模型
FLUX 3:Black Forest Labs发布真实世界模型
FLUX 3Black Forest Labs世界模型world model多模态
Zero-WAM:给机器人看演示视频即可下达新任务
世界模型视频示教上下文提示动作生成免微调
机器人跨平台动作迁移
动作迁移跨平台具身AI动作表示通用性
π0:通用视觉-语言-动作模型
VLAπ0Physical Intelligence通用模型具身AI
Apple EgoDex:戴 Vision Pro 做家务,为机器人灵巧手采数据
灵巧操作数据采集第一人称视频遥操作替代Apple
PolyLayout:多房间3D布局估计
3D布局室内导航感知PolyLayout具身AI
Being-H0.8 为具身AI带来触觉
人形机器人触觉触觉感知具身AIhumanoid
GEN-1具身基础模型:机器人操作的GPT-3时刻
具身AI基础模型VLA操作GEN-1
SuperMap视觉语言导航SLAM系统
SLAMSuperMap视觉语言导航visual-language navigation具身AI
RL²-VLA:自适应RL组合引导框架
VLARL²-VLA测试时缩放强化学习OOD
LUCID:从人类视频学习灵巧操作
灵巧操作视频学习LUCIDUIUCCMU
Apptronik与Google DeepMind合作:用Apollo 2人形机器人训练Gemini Robotics
人形机器人Google DeepMindGemini RoboticsApptronikApollo 2
EgoExoMoCap:分布式第一人称-第三人称人体动捕
动捕motion capture第一人称egocentric具身AI
通过物理代理解决通用机器人的编排鸿沟
TwitterVLA机器人操作编排具身AI
X-NavDP:基于群组Q值分数加权匹配的导航扩散策略泛化框架
导航扩散策略强化学习跨本体NavDP
Zero-WAM:基于人类视频上下文提示的世界-动作建模,实现开放任务泛化
世界模型上下文学习人类视频示教操作泛化视频-动作模型
LeVJEPA:无需启发式技巧的高效可扩展视频预训练
视频自监督预训练JEPA表征坍缩SIGReg块因果注意力
SLAMFormer-∞:面向无界前端与后端处理的无限SLAM变换器
TwitterSLAM三维重建变换器长程SLAM