Skip to content
Robot
World
机器人
视频
零部件
论文
博客
开源
世界模型
模型排行
产业链
投资
机器人
视频
零部件
论文
博客
开源
世界模型
模型排行
产业链
投资
搜索机器人、零部件、论文...
⌘K
EN
physical-ai
[
●
●
●
]
FETCHING
← 标签
#Paper
(149)
EgoHTR:第一人称4D人体地形穿越数据集
步态优化
数据集
人体运动
4D
Terrain Traversal
工业灵巧度基准:面向工业灵巧操作的软硬件基准平台
灵巧操作
工业
基准测试
硬件软件
Paper
DeVA:面向机器人策略学习的物理引导解耦视频-动作模型
VLA
Paper
Vision-Language-Action
STeP:用于VLM动作生成的精确信号时序逻辑规范
视觉语言模型
时序逻辑
动作生成
规范
Paper
DynaWM:动力学感知蒸馏实现双足轮式机器人连续楼梯平滑运动
步态优化
双足轮式
World Model
师生蒸馏
Continuous Stairs
MVP-Tac:面向机器人辅助微创手术的小型化双模视觉光弹性触觉传感器
触觉传感
微创手术
光弹性
双模
Paper
Athena-Brain技术报告:面向通用智能与具身交互的高效机器人大脑
具身智能
机器人大脑
通用智能
系统
Paper
Agentic Real2Sim:基于视觉语言智能体的物理世界建模
世界模型
视觉语言模型
sim-to-real
物理仿真
Paper
IGGT4D:流式4D实例锚定几何Transformer
Spatial Intelligence
Paper
空间智能
Koopman Dreamer:用于稳定世界模型想象的谱约束隐式动力学
世界模型
Dreamer
Koopman
谱约束
强化学习
Extreme-RGMT:面向鲁棒通用人形控制的高动态技能持续学习
人形机器人
持续学习
运动控制
动态技能
Paper
SeededGrasp:多本体复杂场景语言引导抓取
抓取
Grasping
语言引导
Language-Guided
多本体
Booster Lab:可部署人形运动学习的数据中心化管线
步态优化
人形机器人
AMP
Booster T1
Data-Centric
GaitSpan:从行走到跑步的人形机器人步态生长
步态优化
人形机器人
Humanoid
Gait
Reinforcement Learning
面向张拉整体机器人6轴接触力估计的可扩展开源视触觉传感器
触觉传感
张拉整体
6轴力
开源
Paper
ATSplat:通过自适应token扩展的紧凑前馈3DGS
3DGS
前馈
token
自适应
紧凑
RealVDeblur:面向泛化真实世界视频去模糊的一步扩散
Paper
3D Gaussian Splatting
3DGS
MoE-VLA中的涌现组合技能
VLA
混合专家
组合泛化
涌现能力
Paper
流式多智能体自回归扩散模型:带世界状态寄存器
世界模型
多智能体
扩散模型
自回归
Paper
何时规划:学习在反应控制与审慎规划间选择
规划
反应控制
策略选择
Paper
NEO:一次NeRF建模,多次编辑的连续物体操作
灵巧操作
Paper
Manipulation
LENS:面向规划的LLM引导环境简化
LLM
任务规划
环境简化
Paper
面向注意力:基于视觉-语言模型的语言条件再感知
视觉语言模型
Paper
Vision-Language Model
SKooP:对称 Koopman 预测加速腿式机器人运动学习
步态优化
人形机器人
Koopman
强化学习
Reinforcement Learning
探索至关重要:逃离3D高斯泼溅模糊陷阱
Paper
3D Gaussian Splatting
3DGS
PhysCoRe:面向材料感知可变形动力学的物理修正残差世界模型
世界模型
物理仿真
可变形物体
机器人操作
Paper
FELT:从视觉生成触觉信号用于视触觉操作
触觉生成
视触觉
跨模态
操作
Paper
Odin:分布式点云神经渲染的基元级同步
神经渲染
3DGS
点云
分布式
Paper
基于层次化动作分块的离线强化学习
强化学习
动作分块
离线RL
人形机器人
Paper
无需真实世界数据,通过合成视频场景学习多样化人形机器人任务
Paper
人形
Humanoid
GLAM-SLAM:通过流密化和空间分解的实时大规模高斯SLAM
3DGS
SLAM
实时
大规模
建图
GrainGS:面向高效动态新视角合成的梯度解耦高斯泼溅
3DGS
动态场景
新视角合成
梯度解耦
Paper
航空多模态大模型智能体的零样本任务级评估
航空
Aerial
多模态大模型
MLLM
零样本
GS-Agent:通过生成式仿真创建4D物理世界
4D生成
世界模型
3DGS
物理仿真
生成式
AXIS:面向可扩展机器人操作的可增长社区驱动数据引擎
机器人操作
数据引擎
社区驱动
模仿学习
Paper
基于强化学习的人形机器人轮滑运动控制
步态优化
人形机器人
轮滑
强化学习
Inline Skating
3D感知视觉语言模型:隐式与显式几何融合
3D感知
3D-Aware
视觉语言模型
VLM
几何
机器人渲染的机器人分解世界模型
世界模型
World Model
机器人渲染
Robot Rendering
视频
TOM-GS:通过静态高斯时间不透明度调制的可编辑视频表示
Paper
3D Gaussian Splatting
3DGS
X-Morph:人体运动先验跨形态可扩展机器人学习
步态优化
跨形态
运动先验
Retargeting
Legged Robot
假先知:论agent系统中世界模型的安全性
Paper
世界模型
World Model
Fashion-3DLR:基于成对时尚元素的可控3D服装生成
Paper
3D Gaussian Splatting
3DGS
面向上半身人物-物体交互的实时以人为中心世界建模
Paper
世界模型
World Model
基于VR和强化学习的小型人形遥操作移动操作
步态优化
人形机器人
VR
遥操作
Loco-Manipulation
持久计算状态:生成式世界模型的会话运行时
世界模型
World Model
生成式
Generative
运行时
从零开始的规模化原生多模态预训练
多模态
Multimodal
预训练
Pre-Training
原生
锯齿与低纹理环境下稀疏视角视觉重定位
Paper
3D Gaussian Splatting
3DGS
几句话有大用:语言引导的机器人策略合成
VLA
Paper
Vision-Language-Action
PathScale-R1:面向病理图像分析的跨尺度推理
视觉语言模型
Paper
Vision-Language Model
LeapBot-WA:基于预测潜在对齐的世界锚定动作模型
具身智能
Paper
Embodied AI
执行器现实塑形实现零样本 sim-to-real 机器人学习
步态优化
Sim-to-Real
执行器
Zero-Shot
Actuator
未知动力学下机会约束运动规划的一致性约束收紧
运动规划
Motion Planning
约束
Constraint
未知动力学
带动态显式头发的人头部化身
Paper
3D Gaussian Splatting
3DGS
具身GPT-5.1:世界模型的证据?
具身智能
Paper
Embodied AI
编辑前先看:注意力引导相机放置与多视角对齐用于3DGS编辑
3DGS
场景编辑
相机放置
多视角
Paper
绳驱机器人的移动时域估计与非线性模型预测控制
Paper
Simulation
仿真
有效参数与真实行为:机器人学中的重正化——从无穷维到有限维
Paper
Simulation
仿真
受控世界模型的可辨识性研究
世界模型
World Model
可辨识性
Identifiability
受控
即插即用顺应:任意取向顺应轴的在线变阻抗模块化框架
变阻抗
Variable Impedance
顺应
Compliance
模块化
人形机器人通用运动跟踪的关键因素:一项实证研究
人形机器人
运动跟踪
实证研究
全身控制
Paper
覆盖皮肤机器人的触觉撤回反射设计与人因评估
具身智能
Paper
Embodied AI
从运动模仿中学习人形机器人可复用混合运动先验
步态优化
人形机器人
运动先验
Motion Imitation
Humanoid
基于超网络的自适应多任务制导、导航与控制学习
Paper
Simulation
仿真
MEVION:面向高速双臂操作的低成本开源数据采集系统
数据采集
双臂
开源
低成本
模仿学习
PAC-DP:PAC贝叶斯扩散策略学习
灵巧操作
Paper
Manipulation
面向非凸城市空中走廊的无人机导航模型预测规划器
机器人
Robotics
Paper
τ:从未来视觉监督学习触觉增强的视觉-语言-动作模型
VLA
Paper
Vision-Language-Action
KAI:面向数据高效铰接物体操作的运动学感知接口
Paper
Simulation
仿真
多回合长时程规划的物理:从预训练到后训练
Paper
世界模型
World Model
具身操作的数据金字塔
具身智能
Paper
Embodied AI
HyWorldVLA:面向自动驾驶的混合世界建模视觉语言动作模型
VLA
世界模型
自动驾驶
混合建模
Paper
Spatial-IQ:通过分层能力测试解构空间智能
Spatial Intelligence
Paper
空间智能
FA-RDP:频率自适应反应扩散策略
Paper
PAVXploreRL:基于动作探索的物理-动作-视觉世界模型强化学习
世界模型
强化学习
动作探索
具身智能
Paper
MEMENTO:记忆引导的模因代码即策略进化
具身智能
Paper
Embodied AI
PhiZero:基于物理语言的世界模型
Paper
RoboInter1.5:面向机器人交互的整体中间表示
机器人交互
表示学习
中间表示
Paper
面向关节柔性与时变时延遥操作机械臂的深度强化学习自适应增益调节
Reinforcement Learning
强化学习
Paper
非对称折纸弯曲与双腔驱动的一体化灵巧手
灵巧操作
Paper
Manipulation
通过可行动作映射桥接强化学习与最优控制
Paper
Simulation
仿真
RAVEN:可见图规划+无碰撞MPC实现鲁棒人形导航
步态优化
人形机器人
导航
MPC
Navigation
通过足部驱动地形改造实现流变斜坡上的鲁棒双足运动
步态优化
双足机器人
地形交互
Granular
Cleat
ConsiSpace:视频空间推理中学习几何一致性至关重要
Spatial Intelligence
Paper
空间智能
TRW:世界模型作为物化视图的可审计一致性契约
世界模型
World Model
一致性
Consistency
可审计
利用高端街景影像的视觉定位精度潜力
机器人
Robotics
Paper
通过3D高斯显式参数扰动的无网格域随机化
Paper
3D Gaussian Splatting
3DGS
面向视觉-语言-动作操作的Real2Sim2Real:基于AMD ROCm的流水线
具身智能
Paper
Embodied AI
PlanCraft:建筑师启发的渐进式3D住宅场景生成中的草图-细化-布置
Spatial Intelligence
Paper
空间智能
LEACL:面向长时程操作任务的LLM增强自动课程强化学习
Reinforcement Learning
强化学习
Paper
试一次即最优:跨回合探索的去冗余过程记忆
视觉语言模型
Paper
Vision-Language Model
面向视觉-语言导航的双脑最小充分表示
Paper
世界模型
World Model
动力膝踝假肢控制器个性化的回放约束仿真框架
Reinforcement Learning
强化学习
Paper
LabRobFail:化学自助实验室中机器人失效分析基准
具身智能
Paper
Embodied AI
N0-VTLA:基于潜在触觉token的视觉-触觉-语言-动作模型缩放
Paper
Simulation
仿真
N0-TWAM:面向接触丰富操作的触觉原生世界-动作模型缩放
具身智能
Paper
Embodied AI
WorldDiT:面向世界与动作建模的统一扩散架构
Paper
世界模型
World Model
WARL:面向腿式机器人任务无关学习的力矩增强强化学习
具身智能
Paper
Embodied AI
视觉导航的自适应安全裕度学习
视觉导航
安全边际
路径规划
扩散模型
Paper
世界模型记得,演员遗忘:用于持续基于模型强化学习的梦境复演
世界模型
持续学习
强化学习
Dreamer
灾难性遗忘
机器人通过投影视觉抽象学习交流
机器人学习
Robot Learning
视觉抽象
Visual Abstraction
交流
面向高效VLA推理的质心复用运动感知向量量化框架
具身智能
Paper
Embodied AI
FeelWorld:面向分层接触预测与规划的视触觉世界模型
Paper
世界模型
World Model
减轻触觉手套姿态相关伪影的姿态感知建模
灵巧操作
Paper
Manipulation
一手看另一手:动态环境中样本高效的双臂操作多Agent协作
灵巧操作
Paper
Manipulation
Teachy Mini:面向高等教育的知识驱动生成式社交机器人
社交机器人
Social Robot
教育
Education
生成式
FastDSAC:通过约束探索增强策略可塑性实现可扩展人形运动
步态优化
强化学习
SAC
Plasticity
HumanoidBench
面向未见机器人操作的动力学感知元模仿学习
模仿学习
元学习
泛化
动力学
操作
SiPhy:单图像物理属性推理
物理属性
Physical Property
单图像
Single-Image
推理
可扩展因果模仿学习
模仿学习
因果推断
分布偏移
Paper
策略性扩展:通过偏置感知评估和数据采集学习组合泛化
机器人操作
组合泛化
数据采集
偏置
Paper
SubSplat:通过亚像素高斯重参数化的高分辨率像素对齐3DGS
3DGS
亚像素
高分辨率
重参数化
Paper
面向神经解码的自监督一致性增强解耦学习
Paper
Simulation
仿真
基于专家行为先验的强化学习
Reinforcement Learning
强化学习
Paper
通过延迟感知引导融合的异步多模态扩散策略组合
扩散策略
多模态
延迟
异步
Paper
FARO:可行性感知的机器人运动优化
Paper
人形
Humanoid
保持一致:一致性约束增强LVLM鲁棒视觉推理
视觉语言模型
LVLM
视觉推理
Visual Reasoning
一致性
WCM:面向可泛化人机交互的世界-认知模型
具身智能
Paper
Embodied AI
ViTacWorld:面向接触密集型机器人操作的视触觉世界模型
世界模型
World Model
视触觉
Visuo-Tactile
机器人操作
通过搜索分配与零空间体现多手操作策略
具身智能
Paper
Embodied AI
World Translation:通过反向动力学提取和无配对域翻译最小化sim-to-real差距
sim-to-real
域适应
世界模型
反向动力学
Paper
在仿真中预训练视觉灵巧操作
灵巧操作
灵巧手
预训练
sim-to-real
VR遥操作
面向非结构化环境的能力感知可通行性导航
具身智能
Paper
Embodied AI
VTAP夹爪:协同指尖传感与视觉触觉主动掌面实现灵巧手内操作
灵巧手
触觉传感
手内操作
夹爪
Paper
ReferTrack:面向身体化VLA的指代跟踪
VLA
目标跟踪
指代
具身智能
Paper
SILICA:复用扩散先验的玻璃分割与深度估计联合方法
机器人
Robotics
Paper
结构化软体机械臂中本体感受与接触感知的模型解耦策略
软体机器人
本体感受
触觉
解耦
Paper
ZeroSplat:3D高斯泼溅中的泛化指代分割
Paper
3D Gaussian Splatting
3DGS
EA-Nav:学习具有身体感知的安全视觉导航策略
视觉导航
身体感知
安全
具身智能
Paper
Music-JEPA:从动作学习声音世界模型
世界模型
World Model
声音
Sound
JEPA
Geo3R:缓解多模态大模型空间推理幻觉
空间推理
Spatial Reasoning
多模态
Multimodal
幻觉
Dreamer-CPC:基于世界模型的消息学习用于去中心化多智能体强化学习
世界模型
多智能体
强化学习
Dreamer
通信
弥合实验室到店铺的鸿沟:面向零售人形机器人的数据高效后训练与经验驱动学习VLA框架
VLA
人形机器人
零售
数据高效
后训练
MulRobBench:面向安全与安全策略合规的决策级基准
VLA
Paper
Vision-Language-Action
FutureRTC:基于预期条件动作分块的实时机器人执行
VLA
Paper
Vision-Language-Action
ADP:对抗动力学先验实现物理扎根的人形运动控制
步态优化
人形机器人
对抗学习
Adversarial
Reinforcement Learning
多速率非线性MPC实现四足机器人靠墙双足运动
步态优化
四足机器人
MPC
NMPC
Wall-Supported
精度之咒:高精度机器人操作的数据缩放律
灵巧操作
Paper
Manipulation
物理空间中相邻集合的动作优于世界模型中的最佳预测
Paper
世界模型
World Model
通过物理感知策略蒸馏的可解释强化学习
Paper
Simulation
仿真
GuidedAttention:面向OOD鲁棒机器人操作的可解释可纠正视觉注意力
模仿学习
视觉注意力
OOD
可解释
操作
fNIRS引导强化学习实现机器人行为的离线方法
BCI
fNIRS
强化学习
机器人控制
Paper
基于对抗运动先验的人形机器人轮滑运动学习
步态优化
人形机器人
轮滑
AMP
Booster T1
FloAff-Kitchen:通过规范与渐进楼层可供性学习桥接导航与操作
Spatial Intelligence
Paper
空间智能
双刃剑的推理:视觉语言agent的架构与跨阶段鲁棒性
VLA
Paper
Vision-Language-Action
HumoSlope:物理引导的生物力学步态自适应实现人形陡坡行走
步态优化
人形机器人
ZMP
陡坡行走
Humanoid
AniGS:桥接渲染与扩散先验的3D场景动画
Paper
3D Gaussian Splatting
3DGS
QIRF:面向3D高斯泼溅的量子启发非正交函数空间压缩
Paper
3D Gaussian Splatting
3DGS
物理AI治理:贯穿全生命周期的从理论到实践
具身智能
Paper
Embodied AI
GenSplatCodec:通过一步扩散的前馈高斯泼溅压缩
Paper
3D Gaussian Splatting
3DGS