跳到正文
arXiv cs.RO 机器人学· Huapeng Li, Fuxiang Feng, Jinqiu Fan, Shuo Yang, Fengjiao Chen, Xuezhi Cao, Ran Song, Wei Zhang·· 2 天前AI 评分53

RMMBench:面向机器人移动操作的综合评测基准

RMMBench: A Comprehensive Benchmark for Robotic Mobile Manipulation

AI 导读

RMMBench 提出一个统一框架,将高低层级具身任务整合为"导航-操作"任务套件,覆盖 70 个典型任务场景,从局部操作延伸到长时程复合导航,用于评估 VLM 在连续空间中理解语言指令并执行长时程任务的能力。评测结果显示,领先 VLM 在移动操作任务的空间定位上仍面临重大挑战,凸显长时程交互中增强机器人空间感知能力的必要性。该基准已被 CoRL 2026 接收。

来源:arXiv cs.RO 机器人学 · arxiv.org