arXiv cs.RO 机器人学· Haozhuo Zhang, Qiang Zhang, Jian Tang, Mingzhe Ni, Michele Caprio, Angelo Cangelosi, Wei Pan·· 1 天前AI 评分51
Humanoid Horizon:通过并行训练、动态起始与奖励门控延长人形机器人全身 loco-manipulation 的任务时域
Humanoid Horizon: Extending Task Horizon in Whole-Body Loco-Manipulation via Parallel Training, Dynamic Starting, and Reward Gating
AI 导读
Humanoid Horizon 提出统一策略框架,用 Parallel Training、Dynamic Starting 与 Reward Gating 三项机制解决长时域全身 loco-manipulation 中的 easy-reward bias 与 catastrophic forgetting 问题。
来源:arXiv cs.RO 机器人学 · arxiv.org