跳到正文
arXiv cs.RO 机器人学· Salar Asayesh, Hossein Darani, Todd Cao, Evgeny Andriash, Mani Ranjbar·· 1 天前AI 评分49

TIGER:面向稀疏奖励桌面机器人操作的任务空间模仿引导强化学习框架

Task-Space Imitation Guidance for Efficient Reinforcement Learning

AI 导读

CoRL 2026 收录的 TIGER 框架将动作分块模仿策略作为任务空间进度估计器,把预测动作块经控制器感知的动作-运动映射转为末端执行器参考,为 RL 智能体提供稠密进度奖励,同时保留稀疏环境奖励为主目标。

来源:arXiv cs.RO 机器人学 · arxiv.org