arXiv cs.RO 机器人学· Yuchen Zhou, Jiacheng You, Weikang Wan, Weijun Dong, Yang Gao, Jiayuan Mao·· 4 小时前AI 评分55
残差建模缩小机器人学习中回归策略与生成策略的差距
Residual Modeling Closes the Regression and Generative Policy Gap in Robot Learning
AI 导读
论文提出异方差 Student-t 动作回归(HT-Policies),在四个仿真基准和真机评测中取得与生成式策略基线相当的成功率,且训练与推理更快。
来源:arXiv cs.RO 机器人学 · arxiv.org