跳到正文
arXiv cs.RO 机器人学· Shangyuan Yuan, Xinda Qi, Yujiang Pu, Wenliang Guo, Xiaobo Tan·· 1 天前AI 评分55

StairVLA:面向视觉-语言-动作模型的阶段感知分层动作生成框架

StairVLA: Stage-Aware Hierarchical Action Generation for Vision-Language-Action Models

AI 导读

StairVLA 提出阶段感知分层动作生成框架,用部分去噪动作作为粗粒度长时程生成与局部精修的接口,高层 VLA 负责早期去噪,轻量 refiner 以更高频率用最新观测精修局部动作块。

来源:arXiv cs.RO 机器人学 · arxiv.org