机器人 VLA 工作正在聚焦于保留先验并改进动作结构的 OOD 适应
这一时期的机器人 Vision-Language-Action(VLA)论文集中在部署失效点:分布外场景、有限演示和薄弱的动作监督。HarmoWAM、PriorVLA 和 UniSteer 在真实世界操作测试中给出了最清楚的量化信号。
这一时期的机器人 Vision-Language-Action(VLA)论文集中在部署失效点:分布外场景、有限演示和薄弱的动作监督。HarmoWAM、PriorVLA 和 UniSteer 在真实世界操作测试中给出了最清楚的量化信号。
适配预训练 VLA 策略的机器人团队有三个具体检查项:在适配时保留冻结的策略路径;在评估中把长距离接近和接触密集控制分开;当动作标签稀缺时加入结构化辅助目标。共同压力来自在新物体姿态、背景、embodiment 和接触动力学下,用有限演示完成部署。