跳到正文
arXiv cs.RO 机器人学· Seungjun Moon, Subin Jeon, Sangwoo Kim, Hanbyul Joo, Jinwoo Shin·· 6 小时前AI 评分57

RLHND:用视频基础模型从第一视角视频估计手部位姿与触觉信息

RLHND: Video Foundation Models as Physically Grounded Hand Trackers for Robot Learning

AI 导读

RLHND 提出基于视频基础模型的手部跟踪模型,从单目第一视角视频联合估计手部位姿与贴近实际的触觉信息,缓解现有方法仅从裁剪帧回归位姿导致的不准确和物理不一致问题。

来源:arXiv cs.RO 机器人学 · arxiv.org