跳到正文
arXiv cs.RO 机器人学· Mingyu Liu, Chonghao Sima, Tianjian Feng, Hanqing Wang, Cong Chen, Hao Chen, Chunhua Shen·· 2 天前AI 评分49

PerturBot:用扰动训练打破视觉-语言-动作模型的捷径先验

PerturBot: Breaking Shortcut Priors in Vision-Language-Action Models with Perturbative Training

AI 导读

PerturBot 通过任务保持的腕部视角扰动、决策相关字幕增强指令,以及随机与失败轨迹片段重标注,削弱视觉-语言-动作(VLA)策略对模态捷径的依赖,且不改变推理过程。配套提出的 GroundingFscore 是一种离线评分,用于诊断策略对模态捷径的依赖程度,与任务成功率结合可判断策略是否健康扩展。

来源:arXiv cs.RO 机器人学 · arxiv.org