跳到正文
arXiv cs.RO· Wonsuhk Jung, Sundhar Vinodh Sangeetha, Chen Xu, Abhishek Gupta, Masha Itkina, Shreyas Kousik, Haruki Nishimura·· 6 小时前

Bilinear Flow Policy:面向目标条件视觉运动模仿的分布外推

Bilinear Flow Policy: Distributional Extrapolation for Goal-Conditioned Visuomotor Imitation

AI 导读

Bilinear Flow Policy(BFP)是一种结合转导检索与双线性条件流的生成式视觉运动策略,用于解决目标条件模仿学习(GCIL)中目标超出演示分布时的分布外推问题。在五项仿真操作任务中,BFP 的分布外成功率是 GCIL 策略的 2.63 倍、最强外推基线的 1.36 倍;在两项真实任务中较 GCIL 提升 32%。其理论还给出可在部署前预测策略外推能力的诊断方法。

来源:arXiv cs.RO · arxiv.org