跳到正文
arXiv cs.RO 机器人学· Zhaoyang Liu, Kun Jiang, Ziying Song, Diange Yang·· 4 小时前AI 评分45

VGGTWorld-VLA:面向自动驾驶的意图条件化 3D 世界演化

VGGTWorld-VLA: Intent-Conditioned 3D World Evolution for Autonomous Driving

AI 导读

VGGTWorld-VLA 提出一种意图条件化的 VGGT-World 扩展,用于自动驾驶中可控的 3D 世界演化。它通过动作-语义条件机制向未来 token 流注入驾驶语义与自车运动表征,并构建几何-语言-动作桥接以联合条件化未来几何预测。在 NAVSIM 上的评测显示其几何预测性能与基线相当,消融实验支持语义与动作条件化的有效性。

来源:arXiv cs.RO 机器人学 · arxiv.org