arXiv cs.RO 机器人学· Mahmoud Selim, Cristina Cipriani, Karl Henrik Johansson·· 7 小时前AI 评分45
超越策略支持:面向自动驾驶的交互约束离线强化学习框架 ICDP
Beyond Policy Support: Interaction Constrained Offline Reinforcement Learning for Autonomous Driving
AI 导读
研究提出离线强化学习框架 Interaction-Constrained Drive Policy(ICDP),显式控制自动驾驶中的交互分布偏移(IDS),将联合支持退化精确分解为自车支持分量与残余交互支持分量,并通过对比密度比估计恢复后者,无需显式联合密度建模、周围智能体预测或在反应式仿真器中 rollout。
来源:arXiv cs.RO 机器人学 · arxiv.org