arXiv cs.RO 机器人学· Bram Grooten, Joaquin Vanschoren·· 2 天前AI 评分55
研究如何在 VLA 后训练中正确使用数据增强
How (and How Not) to Use Data Augmentation in VLA Post-Training
AI 导读
该研究系统分析了图像增强对 VLA 后训练的影响,发现在 RL 更新中只增强 critic 模块、同时让 actor 在 rollout 和更新时保持干净输入最关键。
来源:arXiv cs.RO 机器人学 · arxiv.org