机器人世界模型现在必须在延迟和数据限制下证明控制价值
这一时期的机器人学习工作集中在能在真实系统上运行的预测控制。MotuBrain、Being-H0.7 和 LaST-R1 给出的信号最清楚:只要未来状态推理能提高长时程动作质量,又不增加部署延迟,它就有价值。
这一时期的机器人学习工作集中在能在真实系统上运行的预测控制。MotuBrain、Being-H0.7 和 LaST-R1 给出的信号最清楚:只要未来状态推理能提高长时程动作质量,又不增加部署延迟,它就有价值。
机器人团队可以用控制测试来检验预测式策略,报告动作质量、p95 推理延迟、更新频率,以及任务数据需求。具体工作包括一个考虑延迟的评测工具、把潜在推理作为策略一部分来更新的 RL 训练后处理,以及一种适用于物理遥操作较慢的接触密集操作任务的 XR 数据采集流程。