跳到正文
arXiv cs.RO 机器人学· Hyun Song, Kangmin Kim, Loren Jinsoo Um, Minhui Han, Jaehyeok Park, Taewan Cho, Andrew Jaeyong Choi·· 2 天前AI 评分55

GeoBridge-VLA 提出几何感知残差适配方法提升 VLA 操作精度

GeoBridge-VLA: Geometry-Aware Residual Adaptation for Vision-Language-Action Models

AI 导读

GeoBridge-VLA 提出一种两阶段方法,从预训练 VLA 的冻结视觉编码器中学习几何特征用于动作预测,Stage I 训练 feature bridge 与 geometry decoder 并用深度监督,Stage II 冻结这些模块后训练门控残差接口与动作侧投影及 action expert。

来源:arXiv cs.RO 机器人学 · arxiv.org