arXiv cs.RO 机器人学· Octi Zhang, Mateo Guaman Castro, Patrick Yin, Ignacio Dagnino, Abhishek Gupta, Rosario Scalise, Byron Boots·· 2 小时前AI 评分58
CoRL 2026 论文提出 Success Guided Sampling 缓解机器人 RL 探索瓶颈
A Balanced Data Diet: Addressing the Exploration Bottleneck in Mega-Scale RL for Robot Control
AI 导读
论文提出 Success Guided Sampling(SGS),一种自适应采样器,将 RL 训练集中到策略能力前沿附近的任务配置,避免在已掌握或尚无法尝试的配置上浪费经验。实验使用最多 2^20(超过一百万)个并行环境,SGS 使 RL 解决了多地形四足运动和接触密集装配任务,而先前方法无法解决;作者还将学到的操纵策略蒸馏为基于 RGB 的策略,在真实硬件上对多个装配任务实现零样本迁移。
来源:arXiv cs.RO 机器人学 · arxiv.org