IROS 2026 大奖揭晓:LT-Mem 长期记忆研究获最佳论文,人形机器人打网球、端托盘获奖
IROS 2026 最佳论文奖颁给 LT-Mem,这项研究用 Live Memory、Delta Memory 和 Meta Memory 三层结构让机器人实现长期场景理解,应对时间性遗忘。
IROS 2026 最佳论文奖颁给 LT-Mem,这项研究用 Live Memory、Delta Memory 和 Meta Memory 三层结构让机器人实现长期场景理解,应对时间性遗忘。
研究提出基于 Vision-Language Models(VLMs)的上下文感知自适应喷洒框架,让机器人结合作物类型、农药类型与天气数据进行空间推理,自适应优化喷洒决策,并采用 MPPI 控制器实现精准导航与定点喷洒。
针对现有Token化机器人策略将离散Token视为无关类别索引、丢弃分词器潜在码本结构的问题,研究者提出码本对齐预测(CAP),直接复用分词器的码向量作为策略类别原型,分词器与策略主干保持不变。
CIRRA 是一个结合 LLM 语义推理与规则约束结构整合的双层框架,用于让机器人在执行任务中持续协调新指令,避免重新生成或大幅修改剩余任务序列。团队同时提出 CHIRP 基准,覆盖 8 类家庭环境和 6 类日常活动共 120 个回合,CIRRA 决策一致率达 74.2%,超出最强重规划基线 30 个百分点。
Robo-COP 让 VLM 编排器与 VLA 策略在部署中共同进化,通过从自身执行中筛选技能演示、在数据能解决反复出现的失败时微调策略,并仅在新策略提升对应技能后才采纳。在十个 RoboLab 仿真任务上,平均留出成功率从冻结策略的 64.8% 提升至 73.8%,而固定计划微调无验证仅达 65.8%;在三个真实任务上从 38.3% 提升至 50.0%。
ProAct 是一种策略无关的动作分词器训练方法,通过策略性增强重建目标来提升下游可预测性与鲁棒性,仅用动作数据集训练。在 Robomimic、LIBERO 和 RoboTwin 基准及多种分词器架构上,ProAct 将 rollout 成功率平均提升 11.3 个百分点;在 VLA 策略和真实机器人操作中分别平均提升 21.8 和 36.7 个百分点。