arXiv cs.RO 机器人学· Mohamed Yassine Kabouri, Pietro Noah Crestaz, Quang-Nam Nguyen, Qilong Cheng, Ludovic Righetti, Nicolas Mansard·· 2 天前AI 评分55
VAMPS:基于采样规划的视觉与运动策略学习框架
VAMPS: Visual and Motor Policies from Sampling-Based Planning
AI 导读
VAMPS 提出用 MPPI 控制训练可复用机器人策略,无需人类示教,支持仿真迭代训练与真实机器人数据直接训练两种模式。仿真模式下策略热启动 MPPI 并用 IQL critic 更新,学到的运动策略迁移到 Unitree Go2;真实模式在 Flexiv Rizon 10S 上用 Action Chunking with Transformers 离线训练,完成抓取放置与力感知白板擦拭。
来源:arXiv cs.RO 机器人学 · arxiv.org