主题概况

Vision Language Action Models

第 3 / 5 页
趋势
24
想法
28
最近一期
2026-07-22
想法 · 日 · 2026-06-24 · Embodied AI

VLA 部署加固

VLA 机器人团队现在有了具体测试目标,用来处理实验室训练后出现的故障:摄像头移动、演示质量弱,以及动作块延迟。最实用的改动是在现有策略周围加入小型部署流程:任务执行前的短探测、模仿学习后的评论器校准在线微调循环,以及用于异步控制的延迟条件适配器。

趋势 · 日 · 2026-06-16 · Embodied AI

机器人VLA工作集中于真实控制条件下的泛化

这一时期的重点是机器人操作。当前工作集中在视觉-语言-动作(VLA)策略上,目标是在不同机器人本体间扩展,在行动前推理,并在部署期间检查自身动作。Qwen-RobotManip是最明确的规模化尝试;其他工作加入潜在规划、世界模型更新、传感器选择、不确定性、记忆和更严格的诊断。

趋势 · 日 · 2026-06-08 · Embodied AI

机器人论文正在集中到时间记忆、恢复和可用控制回路上

视觉语言动作(VLA)机器人工作的效果最好的是那些让策略保留时间状态、在出错后恢复、或接受低延迟人工输入的场景。MemoryVLA++、MotionWAM 和 YUBI 体现了当天的重点:让策略在更长时域上行动,收集更大的真实数据,并让修正尽量贴近执行。

想法 · 日 · 2026-06-08 · Embodied AI

实用的 VLA 部署控制

机器人团队可以围绕冻结的 VLA 策略做出具体改动:加失败专用恢复层、在执行时提供低延迟 steering 和安全滤波、并用更轻的手持夹爪采集双臂数据。共同的落地压力来自实际部署摩擦:策略可以知道任务,但仍可能抓空、撞到附近物体,或者缺少足够多的接触丰富任务示范。