arXiv cs.RO 机器人学· Shangyuan Yuan, Xinda Qi, Yujiang Pu, Wenliang Guo, Xiaobo Tan·· 1 天前AI 评分55
StairVLA:面向视觉-语言-动作模型的阶段感知分层动作生成框架
StairVLA: Stage-Aware Hierarchical Action Generation for Vision-Language-Action Models
AI 导读
StairVLA 提出阶段感知分层动作生成框架,用部分去噪动作作为粗粒度长时程生成与局部精修的接口,高层 VLA 负责早期去噪,轻量 refiner 以更高频率用最新观测精修局部动作块。
来源:arXiv cs.RO 机器人学 · arxiv.org