提出交互约束离线强化学习驾驶框架ICDP
热点事件持续更新
提出交互约束离线强化学习驾驶框架ICDP
1 篇报道1 个报道来源7 小时前更新
先了解这件事
AI 综述
Mahmoud Selim 等研究者提出面向自动驾驶的离线强化学习框架 ICDP,用于显式控制交互分布偏移(IDS),将联合支持退化分解为自车支持分量与残余交互支持分量,并通过对比密度比估计恢复后者,无需显式联合密度建模、周围智能体预测或在反应式仿真器中 rollout。 该框架在 nuPlan、Interplan 及真实卡车实验的闭环评测中,抑制了高价值但交互不支持的轨迹选择,并在交互关键的驾驶场景中提升了性能。
AI 根据报道生成 · 7 小时前更新
最新进展10月8日 12:00
超越策略支持:面向自动驾驶的交互约束离线强化学习框架 ICDP报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- arXiv cs.RO 机器人学超越策略支持:面向自动驾驶的交互约束离线强化学习框架 ICDP
研究提出离线强化学习框架 Interaction-Constrained Drive Policy(ICDP),显式控制自动驾驶中的交互分布偏移(IDS),将联合支持退化精确分解为自车支持分量与残余交互支持分量,并通过对比密度比估计恢复后者,无需显式联合密度建模、周围智能体预测或在反应式仿真器中 rollout。
本事件热度走势
- 可比范围当前
- 8
- 可比范围峰值
- 1010月8日 13:00
- 近 24 小时变化
- –
02.557.510
13:0014:0015:0016:0017:0018:0019:00
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。