arXiv cs.RO 机器人学· Zhouyu Zhang, Chih-Yuan Chiu, Glen Chou·· 7 小时前AI 评分47
通过最优性与反事实正则化在无危险数据下学习未知约束(CF-KKT)
Learning Unknown Constraints without Unsafe Data via Optimality and Counterfactual Regularization
AI 导读
论文提出约束学习框架 Counterfactual KKT(CF-KKT),利用局部学习的可微动力学模型对演示施加 KKT 最优性条件,并生成奖励提升的反事实行为合成不可行数据,从而在无需已知动力学和额外危险探索的情况下恢复未知约束。
来源:arXiv cs.RO 机器人学 · arxiv.org