跳到正文
arXiv cs.RO 机器人学· Alexandra Coroiu, Andrea Vogt, Viktor Werbilo, Andreas Poppele, Johann Christensen, Sven Hallerbach·· 7 小时前AI 评分45

RLHF 用于人机协作的范围综述与实验研究

A Scoping Review and Experimental Study on Reinforcement Learning from Human Feedback for Human-Robot Collaboration

AI 导读

一项针对人机协作(HRC)中 RLHF 的范围综述筛选 199 条记录并纳入 20 篇 2020-2025 年同行评审文献,作者称其为首个聚焦 RLHF 双向闭环设计的综述。随后开展的 VR 被试间实验用贝叶斯模型分析系统发起与用户发起反馈对机器人近端行为安全导航的影响,结果显示用户发起反馈能更好地捕捉感知安全,表明反馈时机直接影响反馈质量。

来源:arXiv cs.RO 机器人学 · arxiv.org