部署适应
多篇论文把已部署机器人视为需要在任务前或任务中获取本地证据的系统。ICWM 让策略先运行一段短暂探测阶段,再把观测到的动作到图像变化作为上下文,用于在新相机视角或新机体配置下控制机器人。FORCE 用在线 rollout 通过校准过的 critic 微调 VLA 策略,并报告真实 Franka 的成功率从行为克隆下的 45.0% 提高到微调后的 98.3%,在线阶段没有人工干预。PhysReflect-VLA 加入执行时可行性检查,并在观测到状态不匹配后进行修正,在长时程任务上带来幅度较小但稳定的真实机器人收益。