RL²-VLA:自适应RL组合引导框架

视频加载中
视频加载中RL²-VLA发现VLA在OOD场景下的测试时缩放规律,提出自适应RL组合引导框架,在成功和失败状态下引导预训练VLA。
Category: research
Author: @derektan1995
Date: 2026-08-05T00:00:00
Duration: 19.4s
Reference: https://github.com/marmotlab/RL2-VLA

RL²-VLA发现VLA在OOD场景下的测试时缩放规律,提出自适应RL组合引导框架,在成功和失败状态下引导预训练VLA。
0:22
2:47
0:17
0:30
1:00
3:08