Skip to content
RobotWorld
标签

#强化学习 (70)

NaP-Control:扩散先验全身角色控制

NaP-Control角色控制扩散先验强化学习全身控制

FACT:让机器人从失败中学习

具身智能Embodied AI机器人学习Robot Learning失败学习

NVIDIA开源人形机器人控制器训练框架

人形机器人NVIDIA强化学习控制器开源

CMU开源HTD人形机器人全身控制器,浏览器里即可试玩

人形机器人全身控制Isaac LabUnitree G1强化学习

REGRIND:从人类重定向轨迹初始化的灵巧RL

灵巧操作Dexterous ManipulationRL强化学习REGRIND

强化学习让机器人自主选择步态跨越障碍

强化学习RL步态地形导航ScienceRobotics

PAC-MAN人形机器人躲避球安全研究

人形机器人安全强化学习PAC-MANhumanoid

模仿+强化学习实现抗干扰毛巾折叠

模仿学习imitation learning强化学习reinforcement learning操控

FetchMan 纯仿真训练人形移动抓取策略

人形具身智能Sim2Real移动操作强化学习

ADEPT:灵巧性仿真预训练与视触觉零样本迁移

ADEPT灵巧手灵巧操作视触觉触觉传感

物理驱动角色控制器的RL训练回顾

强化学习物理角色控制RLcharacter controlneural_avb

强化学习为何样本效率极低

强化学习reinforcement learningsample efficiencyworld model奖励学习

OpenAI模拟训练机器人手解魔方

灵巧手sim-to-real模拟训练OpenAI魔方

Marope:多机器人协同跳绳强化学习

多智能体强化学习机器人协同Marope南京大学

WARL:力矩增强强化学习(IROS 2026)

强化学习RL腿式机器人IROS2026Twitter

RL²-VLA:自适应RL组合引导框架

VLARL²-VLA测试时缩放强化学习OOD

RLbotics:开源机器人强化学习库发布

RLbotics强化学习reinforcement learning开源库IsaacLab

FlexionAI:仿真中用RGB训练机器人RL策略

强化学习RLRGBSim-to-real仿真

复旦RoboMaster轮腿机器人端到端强化学习

轮腿机器人强化学习复旦RoboMasterWheeled-Legged

用于全身末端执行器旋量跟踪的多评论家学习方法

强化学习全身控制多评论家末端执行器四足机器人

VOP-Nav:四足机器人在拥挤环境中的敏捷导航

四足机器人quadruped导航navigation拥挤环境

HITTER:层级规划+学习控制的人形乒乓球机器人

人形Humanoid乒乓球Table Tennis全身控制

使用选择性对抗运动先验的多步态人形机器人学习

人形机器人多步态强化学习对抗运动先验爬楼梯

Koopman Dreamer:用于稳定世界模型想象的谱约束隐式动力学

世界模型DreamerKoopman谱约束强化学习

人形机器人被动移动座椅上的坐姿移动研究

人形机器人Humanoid坐姿移动Seated Locomotion控制策略

学习腿式操作机器人的动态拾取与放置

腿式操作动态抓取强化学习拾取与放置四足机器人

SKooP:对称 Koopman 预测加速腿式机器人运动学习

步态优化人形机器人Koopman强化学习Reinforcement Learning

基于层次化动作分块的离线强化学习

强化学习动作分块离线RL人形机器人Paper

基于强化学习的人形机器人轮滑运动控制

步态优化人形机器人轮滑强化学习Inline Skating

ABot-AgentOS:具备终身多模态记忆的通用机器人智能体操作系统

机器人智能体AgentOS智能体操作系统具身智能多模态记忆

PRIOR:基于参考步态先验的感知人形运动学习

人形机器人强化学习步态先验感知运动Isaac Lab

运动先验重塑:让平地四足技能适应复杂地形

四足机器人运动先验强化学习运动模仿局部导航

通过运动生成和运动跟踪学习全身人形运动

人形机器人全身运动运动生成运动跟踪强化学习

显式楼梯几何条件化用于鲁棒人形运动

人形机器人爬楼梯强化学习地形感知几何条件

RL2-VLA:VLA 模型自适应 RL 潜空间组合引导与测试时扩展

VLA强化学习离线RL推理时引导测试时扩展

X-NavDP:基于群组Q值分数加权匹配的导航扩散策略泛化框架

导航扩散策略强化学习跨本体NavDP

PAVXploreRL:基于动作探索的物理-动作-视觉世界模型强化学习

世界模型强化学习动作探索具身智能Paper

LATENT:从不完美人类动作学习人形网球技能

LATENT人形机器人网球动作学习运动技能

面向关节柔性与时变时延遥操作机械臂的深度强化学习自适应增益调节

Reinforcement Learning强化学习Paper

SimWAM:端到端自动驾驶的简单世界-动作模型

世界-动作模型端到端自动驾驶视频生成流匹配强化学习

HAF:层级动作流与谱潜空间强化学习将通用VLA适配人形全身运动操作

VLA人形机器人humanoid全身控制whole-body

超越模仿:通过离线策略 Q-Planning 实现机器人策略自我改进

机器人操控强化学习行为克隆Q-Learning自改进

部署基于学习的四足移动操作框架

四足操作强化学习sim-to-realROS开源框架

DELTA:面向稀疏地形四足运动的可变形高程局部地形注意力编码器

四足机器人四足运动强化学习地形感知注意力机制

LAC:人形机器人全身线性与角度柔顺控制

人形机器人全身控制柔顺控制导纳控制强化学习

AnyBody:从任意关键点引导的自由形式全身人形控制

人形机器人全身控制关键点引导强化学习运动控制

MLM:学习带臂四足机器人的多任务移动操作全身控制

强化学习移动操作四足机器人多任务全身控制

人形机器人多样姿态起立控制

人形机器人强化学习起立控制sim-to-realUnitree-G1

足式机器人力位统一控制策略

足式机器人移动操作力位控制强化学习Unitree

LEACL:面向长时程操作任务的LLM增强自动课程强化学习

Reinforcement Learning强化学习Paper

动力膝踝假肢控制器个性化的回放约束仿真框架

Reinforcement Learning强化学习Paper

基于感知内部模型学习人形运动

人形机器人感知内部模型强化学习复杂地形运动控制

世界模型记得,演员遗忘:用于持续基于模型强化学习的梦境复演

世界模型持续学习强化学习Dreamer灾难性遗忘

CMoE:面向人形机器人运动控制与地形适应的对比混合专家

人形机器人Unitree G1MoE对比学习地形适应

FastDSAC:通过约束探索增强策略可塑性实现可扩展人形运动

步态优化强化学习SACPlasticityHumanoidBench

学习地形感知的感知式腿式移动操作全身控制

腿式操作地形感知全身控制感知强化学习

CoorDex:协调身体与手部先验实现连续灵巧人形行走操作

人形机器人loco-manipulation灵巧操作强化学习行走操作

基于专家行为先验的强化学习

Reinforcement Learning强化学习Paper

足底压力时空表征驱动人形机器人运动

人形机器人足底压力触觉感知运动控制强化学习

MoE-Loco:面向多任务行走的混合专家方法

混合专家多任务行走腿式机器人强化学习四足机器人

加速度CBF-QP:强化学习策略安全执行框架

强化学习RL安全safetyCBF-QP

Dreamer-CPC:基于世界模型的消息学习用于去中心化多智能体强化学习

世界模型多智能体强化学习Dreamer通信

PRISM:面向交互结构化运动控制的多项式表示

运动控制多项式网络人形机器人强化学习模仿学习

首个可部署动态CoM:人形单腿平衡统一策略与基准

人形机器人单腿平衡动态质心xCoM强化学习

fNIRS引导强化学习实现机器人行为的离线方法

BCIfNIRS强化学习机器人控制Paper

ADEPT:灵巧操作只学一次,新任务即插即用

灵巧操作强化学习sim-to-real预训练dexterous manipulation

Atlas 的进化:从研究机器人到工业人形

Atlas波士顿动力人形机器人工业机器人Hyundai

训练人形机器人做重活

Atlas波士顿动力强化学习RL人形机器人

Meta开源SuperDex:面向灵巧操作的统一仿真平台,接触优先物理引擎+零样本sim2real

Meta灵巧操作dexterous manipulation物理仿真physics engine

足球能教会机器人运动吗?

Atlas波士顿动力强化学习足球动作捕捉