具身策略通过保留与行动相关的状态得到改进
当天最有力的证据强化了最近一次有内容的日度信号:可靠的具身控制依赖于能够在执行过程中持续保留的状态。持久化的三维物体信息、力历史、密集视觉图像块和结构化的未来引导,都能改善操作或规划。结果很有前景,但大多局限于单个机器人和基准;一项鲁棒性研究还表明,加入推理并不能可靠地让策略更安全。
当天最有力的证据强化了最近一次有内容的日度信号:可靠的具身控制依赖于能够在执行过程中持续保留的状态。持久化的三维物体信息、力历史、密集视觉图像块和结构化的未来引导,都能改善操作或规划。结果很有前景,但大多局限于单个机器人和基准;一项鲁棒性研究还表明,加入推理并不能可靠地让策略更安全。
具身控制团队应以不同速率保留不同信息:为当前场景保留密集的空间细节,跨时间压缩为紧凑的物理记录,并使用独立刷新的状态检查执行结果。现有证据还支持通过对动作敏感的干预来评估世界模型,而不能只看生成轨迹是否合理。