arXiv cs.RO 机器人学· Yuzhi Zhang, Xinyu Liu, Yu Zhang·· 2 天前AI 评分54
通过局部恢复监督递归自改进视觉运动策略
Recursive Self-Improvement of Visuomotor Policies through Local Recovery Supervision
AI 导读
该框架通过局部恢复监督实现视觉运动策略的递归自改进:离线审计器定位未解决失败并给出修复目标,固定多模体智能体作为工具型教师生成恢复动作,冻结的学生策略验证续接可行性,仅部署学生。
来源:arXiv cs.RO 机器人学 · arxiv.org