← 标签
#World Model (27)
谷歌Genie 3仅凭街景图像完整模拟现实世界
谷歌Genie 3世界模型街景模拟
EchoWM:可驾驶的世界模型,不只是看的片段
世界模型World ModelEchoWMJoy-Echo6DoF
LingBot-VA因果视频模型机器人控制
世界模型视频模型机器人控制因果模型World Model
τ0-VLA:世界模型驱动测试时搜索的机器人VLA
VLA世界模型World Model测试时搜索机器人操作
Hydra-0:连接物理仿真与世界模型的统一动作流
Hydra-0World ModelAction LanguageSim-to-RealRobot Control
ViTacWorld触觉世界模型
触觉感知世界模型接触建模ViTacWorldTactile Sensing
RoFacto动作条件扩散世界模型
世界模型扩散模型动作条件RoFactoWorld Model
DeWorldSG:概率3D高斯驱动的3D场景图生成
3D场景图Scene Graph3DGS世界模型World Model
NVIDIA Cosmos 3 Edge:4B边缘世界模型驱动机器人
NVIDIACosmos 3 Edge世界模型边缘计算实时机器人
Daimon-TWM触觉世界模型赋能灵巧操作
触觉世界模型灵巧操作DaimonWorld Model
触觉世界动作模型Being-H0.8
触觉感知世界模型具身智能基础模型Tactile Sensing
DynaWM:动力学感知蒸馏实现双足轮式机器人连续楼梯平滑运动
步态优化双足轮式World Model师生蒸馏Continuous Stairs
机器人渲染的机器人分解世界模型
世界模型World Model机器人渲染Robot Rendering视频
假先知:论agent系统中世界模型的安全性
Paper世界模型World Model
面向上半身人物-物体交互的实时以人为中心世界建模
Paper世界模型World Model
持久计算状态:生成式世界模型的会话运行时
世界模型World Model生成式Generative运行时
受控世界模型的可辨识性研究
世界模型World Model可辨识性Identifiability受控
多回合长时程规划的物理:从预训练到后训练
Paper世界模型World Model
TRW:世界模型作为物化视图的可审计一致性契约
世界模型World Model一致性Consistency可审计
面向视觉-语言导航的双脑最小充分表示
Paper世界模型World Model
WorldDiT:面向世界与动作建模的统一扩散架构
Paper世界模型World Model
FeelWorld:面向分层接触预测与规划的视触觉世界模型
Paper世界模型World Model
ViTacWorld:面向接触密集型机器人操作的视触觉世界模型
世界模型World Model视触觉Visuo-Tactile机器人操作
GigaBrain-WBC:人形机器人全身控制的行为世界模型
人形机器人Humanoid世界模型World Model全身控制
Music-JEPA:从动作学习声音世界模型
世界模型World Model声音SoundJEPA
物理空间中相邻集合的动作优于世界模型中的最佳预测
Paper世界模型World Model
GRASP:基于梯度的世界模型长程规划器
世界模型规划梯度优化长程规划World Model