arXiv cs.RO 机器人学· Liuhaichen Yang, Zhuang Jiang, Chenchao Sheng, Ningwei Bai, Qichen Yin, Hanbo Ma, Junkai Liu, Junkai Sun, Dongcheng Lyu, Yi Dong, Zezhi Tang·· 1 天前AI 评分55
Guided Action Flow:面向冻结 VLA 策略的价值引导采样方法
Guided Action Flow: Value-Guided Sampling for Frozen Vision-Language-Action Policies
AI 导读
GAF 通过学习约 2.735M 参数的紧凑 critic 并将其动作梯度作用于逆时流采样,在不更新 0.45B 参数 VLA 策略参数的前提下提升推理时动作生成质量。
来源:arXiv cs.RO 机器人学 · arxiv.org