arXiv cs.RO· Zimu Han, Yiming Zeng, Jiyao Zhang, Zihao Zhao, Yuanfei Wang, Yixiang Jin, Shiqi Li, Shuangben Chen, Wei Huang, Ruodai Li, Hui Shen, Hao Dong·· 6 小时前
HIL-UMI:将 VLA 模型人在回路后训练带入 UMI 框架
HIL-UMI: Bringing Human-in-the-Loop Post-Training of Vision-Language-Action Models to Universal Manipulation Interface
AI 导读
HIL-UMI 是一个基于 Universal Manipulation Interface(UMI)的免机器人人在回路 VLA 后训练框架,通过 Energy Score 判断人类动作与策略推理的偏差来触发数据采集,并用在线优势预测筛选关键片段优化基于进展的优势估计器。
来源:arXiv cs.RO · arxiv.org