arXiv cs.RO 机器人学· Yangsong Zhang, Anujith Muraleedharan, Rikhat Akizhanov, Abdul Ahad Butt, G\"ul Varol, Pascal Fua, Fabio Pizzati, Ivan Laptev·· 4 小时前AI 评分55
PhysMoDPO:用偏好优化实现物理上合理的人形机器人动作生成
PhysMoDPO: Physically-Plausible Humanoid Motion with Preference Optimization
AI 导读
论文提出 PhysMoDPO,一个 Direct Preference Optimization 框架,将 Whole-Body Controller(WBC)纳入训练管线,直接优化扩散模型使 WBC 输出同时符合物理规律与原始文本指令,替代以往依赖脚滑惩罚等手工物理启发式的方法。
来源:arXiv cs.RO 机器人学 · arxiv.org