arXiv cs.RO 机器人学· Zhuo Lin, Sirui Xu, Liuyu Bian, Yu-Xiong Wang, Liang-Yan Gui·· 2 天前AI 评分57
InterEvolve 提出奖励程序测试时进化方法用于人形机器人 loco-manipulation
InterEvolve: Test-Time Evolution of Reward Programs for Humanoid Loco-Manipulation
AI 导读
Zhuo Lin 等人提出 InterEvolve,在不重新训练的前提下让控制器通过测试时进化完成未训练过的人形 loco-manipulation 任务。方法包含 object-aware forward-backward 行为基础模型,以及由 LLM 智能体结合执行反馈与技能库修订结构、数值优化器调节常数的奖励程序。
来源:arXiv cs.RO 机器人学 · arxiv.org