跳到正文
arXiv cs.RO 机器人学· Yuchen Zhou, Jiacheng You, Weikang Wan, Weijun Dong, Yang Gao, Jiayuan Mao·· 4 小时前AI 评分55

残差建模缩小机器人学习中回归策略与生成策略的差距

Residual Modeling Closes the Regression and Generative Policy Gap in Robot Learning

AI 导读

论文提出异方差 Student-t 动作回归(HT-Policies),在四个仿真基准和真机评测中取得与生成式策略基线相当的成功率,且训练与推理更快。

来源:arXiv cs.RO 机器人学 · arxiv.org