arXiv cs.RO 机器人学· Salar Asayesh, Hossein Darani, Todd Cao, Evgeny Andriash, Mani Ranjbar·· 1 天前AI 评分49
TIGER:面向稀疏奖励桌面机器人操作的任务空间模仿引导强化学习框架
Task-Space Imitation Guidance for Efficient Reinforcement Learning
AI 导读
CoRL 2026 收录的 TIGER 框架将动作分块模仿策略作为任务空间进度估计器,把预测动作块经控制器感知的动作-运动映射转为末端执行器参考,为 RL 智能体提供稠密进度奖励,同时保留稀疏环境奖励为主目标。
来源:arXiv cs.RO 机器人学 · arxiv.org