对机器人动作完成情况进行独立的物理状态检查
机器人安全与部署团队应根据独立刷新的物理状态检查动作是否完成,而不是依赖策略的推理轨迹。POT-VLA 展示了如何让同一组按角色索引的 3D 对象记录先用于生成动作,再在执行后刷新,用于检验包含、支撑、对齐或交接关系。与 VLA 鲁棒性研究中的文本计划一致性相比,这提供了更具体的监控依据;后者在自适应攻击下的表现降至接近随机水平。
工程上的改动是:在每个动作片段之后,将对象关系,以及在具备力传感时的接触事件,作为一份小型执行契约显式提供给系统。监控器应接收新的传感器测量,而不是隐藏状态或生成的解释;当证据不确定时,应触发重新观测或恢复。一个有用的首轮测试是分别扰动视觉、力觉和策略内部信息,并在相同误报率下,将这一基于状态的检查与计划–动作一致性监控器和动作异常监控器进行比较;结果可以显示,物理落地是否提供了独立的安全信息,而不是对策略输出的另一种观察。