arXiv cs.RO 机器人学· Senqiao Yang, Chengyao Wang, Yuxin Chen, Zixuan Wang, Longxiang Tang, Haokun Gui, Jinhui Ye, Changsheng Lu, Xiaoyang Wu, Mingkang Zhu, Pengguang Chen, Shu Liu, Zhuotao Tian, Hengshuang Zhao, Bei Yu, Jiaya Jia·· 1 天前AI 评分57
VLAct:面向 VLA 的表示中心继续预训练方法在多项基准上超越工业级系统
Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models
AI 导读
论文提出 VLAct,一种面向 Vision-Language-Action 模型的 VLM 骨干,在任务微调前于多本体机器人数据上继续预训练,通过 VLM 先验保持、多头连续动作协同监督和部分统一的跨本体动作布局来保留通用视觉先验并共享动作语义。
来源:arXiv cs.RO 机器人学 · arxiv.org