跳到正文
arXiv cs.RO· Yangsong Zhang, Anujith Muraleedharan, Rikhat Akizhanov, Abdul Ahad Butt, G\"ul Varol, Pascal Fua, Fabio Pizzati, Ivan Laptev·· 4 小时前

PhysMoDPO:用偏好优化生成物理可行的人形机器人动作

PhysMoDPO: Physically-Plausible Humanoid Motion with Preference Optimization

AI 导读

PhysMoDPO 是一个直接偏好优化框架,将全身控制器(WBC)纳入扩散模型训练流程,使 WBC 输出同时符合物理约束与原始文本指令。在文本到动作和空间控制任务中,该方法在仿真机器人上的物理真实感与任务指标均有稳定提升,并成功应用于 G1 人形机器人的零样本动作迁移与真实部署。

来源:arXiv cs.RO · arxiv.org