arXiv cs.RO 机器人学· Yanjiang Guo, Haodong Yan, Zhide Zhong, Zhongru Zhang, Qingyuan Yang, Qingzhou Lu, Xiaoyu Chen, Yen-Jen Wang, Shuying Deng, Chenghan Yang, Puzhen Yuan, Chenxin Liu, Tun Ban, Xiang Zhu, Yichen Liu, Kun Feng, Haoang Li, Jianyu Chen·· 6 小时前AI 评分57
VPP2 论文:提升视频预测以改善机器人操作策略的零样本泛化
Video Prediction Policy 2: Predict Better, Act Better
AI 导读
论文提出 Video Prediction Policy 2(VPP2),一种世界动作模型(WAM),通过大规模操作视频继续预训练、蒸馏为单步视觉规划器,并以 mixture-of-transformers(MoT)架构引入动作模块,实现视频预测与动作生成的零样本泛化。
来源:arXiv cs.RO 机器人学 · arxiv.org