跳到正文
arXiv cs.RO 机器人学· Kazutoshi Tanaka·· 1 天前AI 评分55

TacZero:用通用视觉-语言模型与触觉反馈实现免训练的插孔操作

TacZero: Training-Free Peg Insertion Using a General-Purpose Vision-Language Model with Tactile Feedback

AI 导读

TacZero 用预训练的通用视觉-语言模型(VLM)解读视觉与触觉观测并直接选择机器人动作,无需额外的触觉或操作训练,也无需针对接触解读与动作选择的任务专用规则。在真实圆柱销插孔实验中,加入数值化三轴触觉输入时 20 次试验成功 15 次,不加触觉输入时仅成功 10 次。该研究为用通用 VLM 做接触密集型操作提供了具体起点,同时指出了这一方向的挑战。

来源:arXiv cs.RO 机器人学 · arxiv.org