跳到正文
arXiv cs.RO 机器人学· Ning Zhu, Mengfei Zhao, Yikai Tang, Zhangyujie Sun, Peihao Li, Dongyue Ni, Jindou Jia, Jianfei Yang·· 2 天前AI 评分52

TUCO:面向 sim-to-real 机器人策略协同训练的仿真演示数据筛选

TUCO: Curating Simulation Demonstrations for Sim-to-Real Robot Policy Co-Training

AI 导读

论文提出 TUCO(Trajectory-level Utility and set-level Coverage Optimization),用影响函数追踪每条源演示对目标域评分 rollout 的影响,将其分解为目标回报总体贡献与 rollout 间差异,作为衡量轨迹效用与集合覆盖的统一闭环标准。

来源:arXiv cs.RO 机器人学 · arxiv.org