Skip to content
RobotWorld
标签

#VLA (100)

DexRobot开源SO101抓取SFT与DM0.5微调工作流

DexRobotSO101DM0.5VLA人形机器人

机器人中心点图让VLA在机器人坐标系感知

VLA具身智能点图机器人感知坐标系

τ0-VLA:世界模型驱动测试时搜索的机器人VLA

VLA世界模型World Model测试时搜索机器人操作

共生知行让宇树G1开卡丁车

共生知行Symbiosis Robotics宇树Unitree G1具身大脑

Galaxea G0.5:推理与动作统一的自回归VLA

VLAGalaxeaG0.5视觉语言动作模型自回归

Google Gemini Robotics 2.0即将发布

人形机器人humanoidGemini RoboticsGoogle双臂

X-Humanoid发布TG-VLA赋予人形机器人类人智能

VLATG-VLAX-Humanoid人形机器人humanoid

T800 搏击机器人:失明是最大问题

HumanoidTwitterVLA人形搏击

Ego2Robot:第一人称视频转训练数据

VLAEgo2Robot数据管线Qwen-RobotManip具身AI

CoorDex让人形机器人边走边操作

人形机器人humanoid全身控制whole-body controlCoorDex

NVIDIA发布DROID+开源机器人控制栈,pi0.5演示hello world操作任务

NVIDIADROIDVLApi0.5开源控制栈

人形机器人进入服装工厂

人形机器人VLA服装制造杰克科技Aitu

Unitree UnifoLM-OminiA-0.3:全模态交互驱动全身移动操作

HumanoidTwitterUnitreeUnifoLMVLA

3D HAMSTER:RGB-D直出3D末端轨迹

3D HAMSTERVLA操作RGB-D3D轨迹

Patch Policy:小Transformer超越大型VLA

Patch PolicyVLAtransformer机器人操作NYU

Astribot Lumo-2:一个基础模型完成 20+ 家庭任务

TwitterVLAAstribotLumo-2人形

Flex-π多流世界动作模型

VLA世界模型WAM双臂Flex-π

Sharpa双手63自由度机器人VLA遥操作

灵巧手DexterousHandVLA遥操作Sharpa

Unitree G1 真产线装配电机(UnifoLM-X1-0)

HumanoidTwitter人形UnitreeG1

mimic-video在LIBERO上效率领先

VLAmimic-videoLIBERO样本效率sample efficiency

Flex-π:速度与精度可切换的机器人基础模型

机器人基础模型VLA世界模型3D感知语义感知

阿里达摩院开源RynnBrain 1.1

人形机器人VLA阿里达摩院RynnBrain开源

TRON 2 VLA自主叠衣服

人形机器人VLALimXTRON2叠衣服

Google DeepMind发布Gemini Robotics 2

VLAGemini RoboticsGoogle DeepMindApptronikApollo 2

MiniCPM-Robot 开源:1.5B 通用 VLA 操作模型

TwitterVLAOpenBMBMiniCPM具身智能

NVIDIA Isaac GR00T N1.7 开源 VLA 基础模型

GR00THumanoidIsaacNVIDIATwitter

TOPReward 零训练机器人奖励模型

VLAReward ModelVLM零训练ZeroTraining

逐际动力TRON 2 VLA主动视觉分拣

人形VLA主动视觉抓取分拣

π0:通用视觉-语言-动作模型

VLAπ0Physical Intelligence通用模型具身AI

阿里达摩院RynnBrain-VLA人形机器人烹饪牛排

人形机器人阿里达摩院RynnBrainVLA烹饪

TRON 2 VLA自主追踪与糖果递送

VLALimX DynamicsTRON 2追踪tracking

SO-101机械臂下棋:π0.5+Stockfish

机械臂SO-101下棋chessπ0.5

机器人自主走房间同时建图(GoDrift 仿真)

TwitterVLA感知导航建图

清华Zetta ζ:给VLA加自愈恢复闭环

ZettaVLA失败恢复自我进化清华

Agentic Real2Sim:从单段视频重建物理仿真器

world modelAgentic Real2Simphysics simulationVLAresearch

TrapVLA:对 VLA 抓取策略的精确故障注入测试

VLAmanipulationadversarialrobustnessTwitter

πR²:流策略实时响应接触

流策略πR²实时控制接触操作

VLA研究中的传感器频率降采样

VLA力觉传感降采样传感器融合控制

AgiBot X2 Ultra 展示行为基础模型

智元机器人AgiBot行为基础模型VLA自主导航

GEN-1具身基础模型:机器人操作的GPT-3时刻

具身AI基础模型VLA操作GEN-1

小米发布Xiaomi-Robotics-1 VLA缩放定律

VLA缩放定律Xiaomi操作UMI

ACT-2 Preview:首个统一泛化与可靠性的机器人模型

TwitterVLAACT-2人形具身智能

Patch Policy:0.7%参数量超越OpenVLA-OFT

VLAPatch PolicyViTOpenVLAmanipulation

Gemini Robotics 2实现人形全身控制

VLAGemini RoboticsGoogle DeepMindApptronikApollo 2

RL²-VLA:自适应RL组合引导框架

VLARL²-VLA测试时缩放强化学习OOD

VLK:视觉-语言-运动学人形操作模型

人形HumanoidVLAKinematics运动学

WAIC 2026:真实世界运行的机器人多样性合集(含端到端模型)

HumanoidTwitterVLAWAICWAIC 2026

人形机器人照护交互渐行渐近

Twitter人形机器人照护机器人VLA具身智能

τ0-VLA长时序机器人基础模型

VLA基础模型长时序操作Foundation ModelLong-Horizon Manipulation

世界行动模型 (WAMs):统一 VLA 与世界模型

具身智能Embodied AIVLA世界模型World Models

DeVA:面向机器人策略学习的物理引导解耦视频-动作模型

VLAPaperVision-Language-Action

Patch Policy:利用稠密视觉表征的高效具身控制

Patch Policydense visual representationDINOv2WebSSLVLA

像机器人一样看:面向VLA模型的机器人中心点图

VLApointmap机器人感知坐标系对齐cross-viewpoint

VLK:在重建场景中合成人类交互,学习人形机器人移动操作

humanoid人形机器人loco-manipulation移动操作synthetic data

TemporalFlow-VLA:用机器人表面时间流为长时程操作学习执行历史

VLA视觉-语言-动作时间流Temporal Flow长时程操作

FM-VLA:接触丰富操作的力觉记忆增强VLA模型

VLA力觉感知触觉记忆增强接触丰富操作

GigaBrain-0.7:用三系统架构扩展具身基础模型的涌现能力

VLA具身智能世界模型GigaBrainFlow Matching

Zetta:冻结策略模型,让执行框架自进化出物理智能

具身智能Embodied AIVLA智能体框架Agentic Harness

Helix: 人形机器人全身控制的大规模神经网络

Figure AIHelix人形VLA端到端

MoE-VLA中的涌现组合技能

VLA混合专家组合泛化涌现能力Paper

AeroAct:语言条件四旋翼飞行的世界-动作模型

无人机UAV四旋翼quadrotor世界模型

闭环人形VLA:面向可验证位操作的三维物体持久化令牌

人形机器人VLA位操作3D物体令牌闭环执行

FlashVLA:流式动作解码实现快速异步 VLA 推理

VLAflow matching流式解码异步推理低延迟

通过物理代理解决通用机器人的编排鸿沟

TwitterVLA机器人操作编排具身AI

ABot-AgentOS:具备终身多模态记忆的通用机器人智能体操作系统

机器人智能体AgentOS智能体操作系统具身智能多模态记忆

几句话有大用:语言引导的机器人策略合成

VLAPaperVision-Language-Action

τ:从未来视觉监督学习触觉增强的视觉-语言-动作模型

VLAPaperVision-Language-Action

HyWorldVLA:面向自动驾驶的混合世界建模视觉语言动作模型

VLA世界模型自动驾驶混合建模Paper

HiFi-UMI:仅用高保真 UMI 数据学习可部署操作策略

操作策略UMI数据采集VLA模仿学习

πR²:反应式实时流策略

机械臂操作扩散策略实时控制VLA闭环控制

RL2-VLA:VLA 模型自适应 RL 潜空间组合引导与测试时扩展

VLA强化学习离线RL推理时引导测试时扩展

X-NavDP:基于群组Q值分数加权匹配的导航扩散策略泛化框架

导航扩散策略强化学习跨本体NavDP

Ego2Robot:从第一人称人类视频合成可扩展机器人数据

VLA机器人操作数据合成第一人称视频动作重定向

PhyAI:边缘实时物理AI推理引擎

Physical AI推理引擎VLA世界模型边缘部署

CosFly-VLA:空间感知的无人机跟踪视觉-语言-动作模型

无人机UAVVLA目标跟踪tracking

StageWAM:面向机器人操作世界-动作模型的阶段联合嵌入预测

机器人操作世界模型JEPAWAMVLA

G0.5:单一自回归流统一机器人推理与动作

VLA具身智能自回归思维链人形机器人

HAF:层级动作流与谱潜空间强化学习将通用VLA适配人形全身运动操作

VLA人形机器人humanoid全身控制whole-body

EATR-Stereo:面向人形机器人视觉-语言-动作控制的具身感知Token路由框架

VLAstereo visiontoken routinghumanoid robotembodiment-aware

DECOWAM:面向腿式移动操作的解耦全身世界-动作模型

世界模型VLA移动操作四足机器人全身控制

超越模仿:通过离线策略 Q-Planning 实现机器人策略自我改进

机器人操控强化学习行为克隆Q-Learning自改进

RT-2: 视觉-语言-动作模型将网络知识迁移到机器人

VLAGoogle具身智能零样本语言指令

GR00T N1: NVIDIA 人形机器人基础模型

NVIDIA人形基础模型IsaacVLA

AtlasVLA:面向VLA模型的持久化世界-自我状态建模

VLA世界-自我状态持久记忆扩散Transformer腕部相机

ReferTrack:面向身体化VLA的指代跟踪

VLA目标跟踪指代具身智能Paper

弥合实验室到店铺的鸿沟:面向零售人形机器人的数据高效后训练与经验驱动学习VLA框架

VLA人形机器人零售数据高效后训练

MulRobBench:面向安全与安全策略合规的决策级基准

VLAPaperVision-Language-Action

FutureRTC:基于预期条件动作分块的实时机器人执行

VLAPaperVision-Language-Action

双刃剑的推理:视觉语言agent的架构与跨阶段鲁棒性

VLAPaperVision-Language-Action

JoyNexus:VLA模型面向服务的多租户后训练

VLA后训练post-training多租户multi-tenant

开发者拐点:乐聚开源 LeTools 后训练工具链,把具身智能开发从周级压到天级

具身智能LeToolssim-to-real行为树VLA

Perceptron 开源 Isaac 0.5:首个同时横跨视频理解、具身推理与机器人控制的开源基础模型,视频数据换遥操作省 210×

具身基础模型embodied foundation model扩展定律scaling lawVLA

LingBot-VLA 2.0 复现雷达:权重已开放,但 6 万小时预训练仍无法等价复刻

LingBot-VLAVLA复现雷达RoboTwin具身智能

Skild S1:机器人界的 GPT-3 时刻——看一段视频就学会新任务,无需微调

Skild AIS1上下文学习in-context learning机器人基础模型

Helix 02:Figure 发布首个全身行走-操作统一 VLA 模型

Figure AIHelix人形机器人VLA行走操作

Helix 学会叠衣服:人形机器人首次实现多指手自主叠衣

Figure AIHelix灵巧操作叠衣服VLA

两只手比一个大脑更难:VLA 双臂操作与真实部署全景综述解读

双臂操作VLAbimanualflow matching动作分块

Zetta ζ:冻结 VLA 权重也能持续进化——清华 AIR 的闭环具身执行框架

具身智能embodied AIVLA自我进化self-evolution

moz1

轮式Wheeled千寻智能Spirit AIMoz1

ollobot-olloni

陪伴机器人赛博宠物VLA端侧智能情感交互