跳到正文
arXiv cs.RO 机器人学· Zheyu Zhuang, Ruiyu Wang, Nick Heppert, Johannes Fabian Hahn, Abhinav Valada, Florian T. Pokorny, Danica Kragic·· 2 小时前AI 评分58

Seeker:从动作中学习视觉注意力的机器人策略学习方法

Attention from Action, for Action: Emergent Visual Bottlenecks for Policy Learning

AI 导读

论文提出Seeker,一种任务与状态条件化的读出机制,从冻结的DINOv3特征出发,仅用动作监督迭代更新查询,生成随任务进度变化的ROI,用作RGB裁剪、掩码引导背景增强和点云过滤的空间接口。

来源:arXiv cs.RO 机器人学 · arxiv.org