跳到正文
arXiv cs.RO 机器人学· Ruizhe Liao, Wenrui Chen, Liangji Zeng, Haoran Lin, Fan Yang, Kailun Yang, Yaonan Wang·· 1 天前AI 评分52

DexPIE:从真实部署经验中稳定提升灵巧操作策略

DexPIE: Stable Dexterous Policy Improvement from Real-World Experience

AI 导读

DexPIE 在三个真实世界灵巧操作任务上将成功率较基于演示的参考策略提升 37.3%,超过所有基线方法。该后训练框架通过灵巧手适配的干预系统与多阶段 DAgger 式数据采集扩大探索覆盖,并以连续最优性指示器条件化策略,更细粒度地利用数据质量。源代码与数据集将公开发布。

来源:arXiv cs.RO 机器人学 · arxiv.org