arXiv cs.RO 机器人学· Seungjun Moon, Subin Jeon, Sangwoo Kim, Hanbyul Joo, Jinwoo Shin·· 6 小时前AI 评分57
RLHND:用视频基础模型从第一视角视频估计手部位姿与触觉信息
RLHND: Video Foundation Models as Physically Grounded Hand Trackers for Robot Learning
AI 导读
RLHND 提出基于视频基础模型的手部跟踪模型,从单目第一视角视频联合估计手部位姿与贴近实际的触觉信息,缓解现有方法仅从裁剪帧回归位姿导致的不准确和物理不一致问题。
来源:arXiv cs.RO 机器人学 · arxiv.org