跳到正文
arXiv cs.RO 机器人学· Haozhuo Zhang, Qiang Zhang, Jian Tang, Mingzhe Ni, Michele Caprio, Angelo Cangelosi, Wei Pan·· 1 天前AI 评分51

Humanoid Horizon:通过并行训练、动态起始与奖励门控延长人形机器人全身 loco-manipulation 的任务时域

Humanoid Horizon: Extending Task Horizon in Whole-Body Loco-Manipulation via Parallel Training, Dynamic Starting, and Reward Gating

AI 导读

Humanoid Horizon 提出统一策略框架,用 Parallel Training、Dynamic Starting 与 Reward Gating 三项机制解决长时域全身 loco-manipulation 中的 easy-reward bias 与 catastrophic forgetting 问题。

来源:arXiv cs.RO 机器人学 · arxiv.org