← 标签
#VLA (100)
DexRobot开源SO101抓取SFT与DM0.5微调工作流
DexRobotSO101DM0.5VLA人形机器人
机器人中心点图让VLA在机器人坐标系感知
VLA具身智能点图机器人感知坐标系
τ0-VLA:世界模型驱动测试时搜索的机器人VLA
VLA世界模型World Model测试时搜索机器人操作
共生知行让宇树G1开卡丁车
共生知行Symbiosis Robotics宇树Unitree G1具身大脑
Galaxea G0.5:推理与动作统一的自回归VLA
VLAGalaxeaG0.5视觉语言动作模型自回归
Google Gemini Robotics 2.0即将发布
人形机器人humanoidGemini RoboticsGoogle双臂
X-Humanoid发布TG-VLA赋予人形机器人类人智能
VLATG-VLAX-Humanoid人形机器人humanoid
T800 搏击机器人:失明是最大问题
HumanoidTwitterVLA人形搏击
Ego2Robot:第一人称视频转训练数据
VLAEgo2Robot数据管线Qwen-RobotManip具身AI
CoorDex让人形机器人边走边操作
人形机器人humanoid全身控制whole-body controlCoorDex
NVIDIA发布DROID+开源机器人控制栈,pi0.5演示hello world操作任务
NVIDIADROIDVLApi0.5开源控制栈
人形机器人进入服装工厂
人形机器人VLA服装制造杰克科技Aitu
Unitree UnifoLM-OminiA-0.3:全模态交互驱动全身移动操作
HumanoidTwitterUnitreeUnifoLMVLA
3D HAMSTER:RGB-D直出3D末端轨迹
3D HAMSTERVLA操作RGB-D3D轨迹
Patch Policy:小Transformer超越大型VLA
Patch PolicyVLAtransformer机器人操作NYU
Astribot Lumo-2:一个基础模型完成 20+ 家庭任务
TwitterVLAAstribotLumo-2人形
Flex-π多流世界动作模型
VLA世界模型WAM双臂Flex-π
Sharpa双手63自由度机器人VLA遥操作
灵巧手DexterousHandVLA遥操作Sharpa
Unitree G1 真产线装配电机(UnifoLM-X1-0)
HumanoidTwitter人形UnitreeG1
mimic-video在LIBERO上效率领先
VLAmimic-videoLIBERO样本效率sample efficiency
Flex-π:速度与精度可切换的机器人基础模型
机器人基础模型VLA世界模型3D感知语义感知
阿里达摩院开源RynnBrain 1.1
人形机器人VLA阿里达摩院RynnBrain开源
TRON 2 VLA自主叠衣服
人形机器人VLALimXTRON2叠衣服
Google DeepMind发布Gemini Robotics 2
VLAGemini RoboticsGoogle DeepMindApptronikApollo 2
MiniCPM-Robot 开源:1.5B 通用 VLA 操作模型
TwitterVLAOpenBMBMiniCPM具身智能
NVIDIA Isaac GR00T N1.7 开源 VLA 基础模型
GR00THumanoidIsaacNVIDIATwitter
TOPReward 零训练机器人奖励模型
VLAReward ModelVLM零训练ZeroTraining
逐际动力TRON 2 VLA主动视觉分拣
人形VLA主动视觉抓取分拣
π0:通用视觉-语言-动作模型
VLAπ0Physical Intelligence通用模型具身AI
阿里达摩院RynnBrain-VLA人形机器人烹饪牛排
人形机器人阿里达摩院RynnBrainVLA烹饪
TRON 2 VLA自主追踪与糖果递送
VLALimX DynamicsTRON 2追踪tracking
SO-101机械臂下棋:π0.5+Stockfish
机械臂SO-101下棋chessπ0.5
机器人自主走房间同时建图(GoDrift 仿真)
TwitterVLA感知导航建图
清华Zetta ζ:给VLA加自愈恢复闭环
ZettaVLA失败恢复自我进化清华
Agentic Real2Sim:从单段视频重建物理仿真器
world modelAgentic Real2Simphysics simulationVLAresearch
TrapVLA:对 VLA 抓取策略的精确故障注入测试
VLAmanipulationadversarialrobustnessTwitter
πR²:流策略实时响应接触
流策略πR²实时控制接触操作
VLA研究中的传感器频率降采样
VLA力觉传感降采样传感器融合控制
AgiBot X2 Ultra 展示行为基础模型
智元机器人AgiBot行为基础模型VLA自主导航
GEN-1具身基础模型:机器人操作的GPT-3时刻
具身AI基础模型VLA操作GEN-1
小米发布Xiaomi-Robotics-1 VLA缩放定律
VLA缩放定律Xiaomi操作UMI
ACT-2 Preview:首个统一泛化与可靠性的机器人模型
TwitterVLAACT-2人形具身智能
Patch Policy:0.7%参数量超越OpenVLA-OFT
VLAPatch PolicyViTOpenVLAmanipulation
Gemini Robotics 2实现人形全身控制
VLAGemini RoboticsGoogle DeepMindApptronikApollo 2
RL²-VLA:自适应RL组合引导框架
VLARL²-VLA测试时缩放强化学习OOD
VLK:视觉-语言-运动学人形操作模型
人形HumanoidVLAKinematics运动学
WAIC 2026:真实世界运行的机器人多样性合集(含端到端模型)
HumanoidTwitterVLAWAICWAIC 2026
人形机器人照护交互渐行渐近
Twitter人形机器人照护机器人VLA具身智能
τ0-VLA长时序机器人基础模型
VLA基础模型长时序操作Foundation ModelLong-Horizon Manipulation
世界行动模型 (WAMs):统一 VLA 与世界模型
具身智能Embodied AIVLA世界模型World Models
DeVA:面向机器人策略学习的物理引导解耦视频-动作模型
VLAPaperVision-Language-Action
Patch Policy:利用稠密视觉表征的高效具身控制
Patch Policydense visual representationDINOv2WebSSLVLA
像机器人一样看:面向VLA模型的机器人中心点图
VLApointmap机器人感知坐标系对齐cross-viewpoint
VLK:在重建场景中合成人类交互,学习人形机器人移动操作
humanoid人形机器人loco-manipulation移动操作synthetic data
TemporalFlow-VLA:用机器人表面时间流为长时程操作学习执行历史
VLA视觉-语言-动作时间流Temporal Flow长时程操作
FM-VLA:接触丰富操作的力觉记忆增强VLA模型
VLA力觉感知触觉记忆增强接触丰富操作
GigaBrain-0.7:用三系统架构扩展具身基础模型的涌现能力
VLA具身智能世界模型GigaBrainFlow Matching
Zetta:冻结策略模型,让执行框架自进化出物理智能
具身智能Embodied AIVLA智能体框架Agentic Harness
Helix: 人形机器人全身控制的大规模神经网络
Figure AIHelix人形VLA端到端
MoE-VLA中的涌现组合技能
VLA混合专家组合泛化涌现能力Paper
AeroAct:语言条件四旋翼飞行的世界-动作模型
无人机UAV四旋翼quadrotor世界模型
闭环人形VLA:面向可验证位操作的三维物体持久化令牌
人形机器人VLA位操作3D物体令牌闭环执行
FlashVLA:流式动作解码实现快速异步 VLA 推理
VLAflow matching流式解码异步推理低延迟
通过物理代理解决通用机器人的编排鸿沟
TwitterVLA机器人操作编排具身AI
ABot-AgentOS:具备终身多模态记忆的通用机器人智能体操作系统
机器人智能体AgentOS智能体操作系统具身智能多模态记忆
几句话有大用:语言引导的机器人策略合成
VLAPaperVision-Language-Action
τ:从未来视觉监督学习触觉增强的视觉-语言-动作模型
VLAPaperVision-Language-Action
HyWorldVLA:面向自动驾驶的混合世界建模视觉语言动作模型
VLA世界模型自动驾驶混合建模Paper
HiFi-UMI:仅用高保真 UMI 数据学习可部署操作策略
操作策略UMI数据采集VLA模仿学习
πR²:反应式实时流策略
机械臂操作扩散策略实时控制VLA闭环控制
RL2-VLA:VLA 模型自适应 RL 潜空间组合引导与测试时扩展
VLA强化学习离线RL推理时引导测试时扩展
X-NavDP:基于群组Q值分数加权匹配的导航扩散策略泛化框架
导航扩散策略强化学习跨本体NavDP
Ego2Robot:从第一人称人类视频合成可扩展机器人数据
VLA机器人操作数据合成第一人称视频动作重定向
PhyAI:边缘实时物理AI推理引擎
Physical AI推理引擎VLA世界模型边缘部署
CosFly-VLA:空间感知的无人机跟踪视觉-语言-动作模型
无人机UAVVLA目标跟踪tracking
StageWAM:面向机器人操作世界-动作模型的阶段联合嵌入预测
机器人操作世界模型JEPAWAMVLA
G0.5:单一自回归流统一机器人推理与动作
VLA具身智能自回归思维链人形机器人
HAF:层级动作流与谱潜空间强化学习将通用VLA适配人形全身运动操作
VLA人形机器人humanoid全身控制whole-body
EATR-Stereo:面向人形机器人视觉-语言-动作控制的具身感知Token路由框架
VLAstereo visiontoken routinghumanoid robotembodiment-aware
DECOWAM:面向腿式移动操作的解耦全身世界-动作模型
世界模型VLA移动操作四足机器人全身控制
超越模仿:通过离线策略 Q-Planning 实现机器人策略自我改进
机器人操控强化学习行为克隆Q-Learning自改进
RT-2: 视觉-语言-动作模型将网络知识迁移到机器人
VLAGoogle具身智能零样本语言指令
GR00T N1: NVIDIA 人形机器人基础模型
NVIDIA人形基础模型IsaacVLA
AtlasVLA:面向VLA模型的持久化世界-自我状态建模
VLA世界-自我状态持久记忆扩散Transformer腕部相机
ReferTrack:面向身体化VLA的指代跟踪
VLA目标跟踪指代具身智能Paper
弥合实验室到店铺的鸿沟:面向零售人形机器人的数据高效后训练与经验驱动学习VLA框架
VLA人形机器人零售数据高效后训练
MulRobBench:面向安全与安全策略合规的决策级基准
VLAPaperVision-Language-Action
FutureRTC:基于预期条件动作分块的实时机器人执行
VLAPaperVision-Language-Action
双刃剑的推理:视觉语言agent的架构与跨阶段鲁棒性
VLAPaperVision-Language-Action
JoyNexus:VLA模型面向服务的多租户后训练
VLA后训练post-training多租户multi-tenant
开发者拐点:乐聚开源 LeTools 后训练工具链,把具身智能开发从周级压到天级
具身智能LeToolssim-to-real行为树VLA
Perceptron 开源 Isaac 0.5:首个同时横跨视频理解、具身推理与机器人控制的开源基础模型,视频数据换遥操作省 210×
具身基础模型embodied foundation model扩展定律scaling lawVLA
LingBot-VLA 2.0 复现雷达:权重已开放,但 6 万小时预训练仍无法等价复刻
LingBot-VLAVLA复现雷达RoboTwin具身智能
Skild S1:机器人界的 GPT-3 时刻——看一段视频就学会新任务,无需微调
Skild AIS1上下文学习in-context learning机器人基础模型
Helix 02:Figure 发布首个全身行走-操作统一 VLA 模型
Figure AIHelix人形机器人VLA行走操作
Helix 学会叠衣服:人形机器人首次实现多指手自主叠衣
Figure AIHelix灵巧操作叠衣服VLA
两只手比一个大脑更难:VLA 双臂操作与真实部署全景综述解读
双臂操作VLAbimanualflow matching动作分块
Zetta ζ:冻结 VLA 权重也能持续进化——清华 AIR 的闭环具身执行框架
具身智能embodied AIVLA自我进化self-evolution
moz1
轮式Wheeled千寻智能Spirit AIMoz1
ollobot-olloni
陪伴机器人赛博宠物VLA端侧智能情感交互