arXiv cs.RO 机器人学· Lemon Foxmere, Anthony Furman, Yizheng Du, Oliver Chang, Leilani Gilpin, Steve McGuire·· 2 小时前AI 评分55
arXiv 论文提出三阶段方法让四足机器人用单一策略掌握 22 项技能
Teaching a Robot Dog New Tricks: Diverse Quadruped Skills via Combined Reinforcement and Imitation Learning with Adversarial Task Selection
AI 导读
论文提出三阶段方法,先用 RL 训练多个窄任务教师策略,再以多教师蒸馏配合 RL 与模仿学习目标、并用对抗式任务选择聚焦表现最差的任务,训练单一学生策略。该学生策略用 8 个教师完成 22 项任务,可组合出爬行等新行为,评测显示其运动质量与指令跟踪优于 PPO 和先蒸馏后微调基线,并在 Unitree B1 四足机器人上完成真实部署验证。
来源:arXiv cs.RO 机器人学 · arxiv.org