跳到正文
arXiv cs.RO 机器人学· Liuhaichen Yang, Zhuang Jiang, Chenchao Sheng, Ningwei Bai, Qichen Yin, Hanbo Ma, Junkai Liu, Junkai Sun, Dongcheng Lyu, Yi Dong, Zezhi Tang·· 1 天前AI 评分55

Guided Action Flow:面向冻结 VLA 策略的价值引导采样方法

Guided Action Flow: Value-Guided Sampling for Frozen Vision-Language-Action Policies

AI 导读

GAF 通过学习约 2.735M 参数的紧凑 critic 并将其动作梯度作用于逆时流采样,在不更新 0.45B 参数 VLA 策略参数的前提下提升推理时动作生成质量。

来源:arXiv cs.RO 机器人学 · arxiv.org