跳到正文
arXiv cs.RO 机器人学· Minye Wu, Zehao Wang, Tinne Tuytelaars·· 4 小时前AI 评分47

空间语言建模统一策略学习与状态预测(Push-T 实机验证)

Unifying Policy Learning and State Prediction through Spatial Language Modeling

AI 导读

研究提出 Spatial Language Modeling,用离散坐标与语义 token 的共享词表表示场景轮廓、目标与未来状态,由单个自回归 Transformer 通过统一 next-token 目标同时学习动作生成与动作条件状态预测。

来源:arXiv cs.RO 机器人学 · arxiv.org