实时 VLA 控制
三篇论文分别针对控制延迟的不同来源。去除时间冗余的方法缓存稳定的视觉令牌,并将流采样压缩为两步;在 LIBERO 上达到 8.2 FPS,平均成功率为 93.8%,而原始策略为 94.4%。Jetson-PI 则预测未来表征,以纠正异步推理中的过时观测;系统优化将 Jetson Orin 的控制频率从 0.70 Hz 提升至 6.06 Hz。ChunkFlow 通过边界感知训练和重叠融合补充原始速度,在 LIBERO-Long 上报告 93.4% 的成功率和 4.43 ms 的推理延迟。综合来看,实用的 VLA 控制取决于视觉感知复用、动作生成、硬件调度和动作块执行之间的协同。