arXiv cs.RO 机器人学· Ting Huang, Lisiyu Pan, Haoyu Wang, Zeyu Zhang, Siyuan Qian, Yanjun Li, Yandong Guo, Boxin Shi, Hao Tang·· 6 小时前AI 评分58
RFPO:面向机器人控制的流策略单步执行优化框架
RFPO: Rectified Flow Policy Optimization for Embodied Control
AI 导读
RFPO 是一个面向连续机器人控制的流策略优化框架,用 Reward-aware 在线 Reflow 修正学生策略的传输路径,并以冻结的 Gaussian PPO 控制器在完整与中间积分预算下提供动作空间监督,使部署策略只需单步 Euler 积分即可执行。
来源:arXiv cs.RO 机器人学 · arxiv.org