跳到正文
arXiv cs.RO 机器人学· Yutian Zhang, Xingrui Xiong, Siyuan Ma, Yang Li, Jiawen Wen, Jiaqi Zhai, Liwen Yang, Ce Hao, Haozhen Chi, Yangkun Zhu, Yifan Zhu, Xiaowen Chu, Dong Wei, Qiaojun Yu, Dibo Hou·· 1 天前AI 评分55

VOMMI:用便携 RGB 演示支撑移动操作 VLA 后训练

VOMMI: Collecting and Leveraging Portable Demonstrations for Mobile Manipulation

AI 导读

VOMMI 是一个便携演示采集与学习框架,通过离线轨迹重建和在线视觉运动条件化,把 RGB 演示接入视觉语言动作(VLA)后训练,无需人机运动学对应标定。实验每个任务采集 500 条便携轨迹,其中 75 条留作 RGB-VO 评估,另用 200 条机器人演示作参照;仅用便携演示后训练的策略基座速度误差比用机器人演示训练的低 18.2%,末端执行器平移精度相当。

来源:arXiv cs.RO 机器人学 · arxiv.org