π0.7:可操控的通用机器人基础模型与涌现能力Physical Intelligence 提出可操控的机器人基础模型 π0.7:通过语言指令、子目标图像与任务元数据等多模态上下文条件化,在未见环境多阶段任务、零样本跨本体泛化中开箱即用,性能比肩 RL 微调专用策略,并展现涌现能力。Physical Intelligence, Bo Ai, Ali Amin·2026年4月16日机器人基础模型视觉语言动作模型vision-language-action2026年4月16日
MoE-VLA中的涌现组合技能混合专家视觉语言动作模型(VLA)在规模扩展时展现涌现的组合技能。本文研究MoE-VLA架构中组合泛化能力的涌现机制及其对机器人操作的影响。Shlok Shah, Rhiaan Jhaveri, Tharun Kumar Tiruppali Kalidoss·2026年7月22日视觉语言动作模型混合专家组合泛化2026年7月22日