跳到正文
今天10月8日周四32 条
  1. arXiv cs.RO

    面向多物体多目标抛掷的快速规划框架

    研究团队提出多物体多目标抛掷(MOMT)规划框架,通过离线构建可行集模型、在线快速匹配与过滤,可在 5 ms 内生成多次抛掷序列。在 7 自由度机械臂配多指手上验证:仿真中双物体协同抛掷执行时间最多减少 46%,三物体仍保持该提升;真实实验双物体减少 29%。目标位置中途随机改变时,系统可在 100 ms 内重新规划并命中新目标,无需停机。

  2. arXiv cs.RO

    2D 协同演化通信机制迁移到 3D 物理仿真器的评估

    研究将两个机器人智能体在离散 2D 仿真器中协同演化出的通信机制迁移到带真实物理的 3D 仿真器,考察其功能角色能否保留。结果显示成功率随评估时间预算近似线性上升,在 2,000 至 6,000 物理步之间未见平台期,说明短回合评估可能低估控制器性能。两种仿真器中社交线索主要充当卡死协助机制而非导航引导,8 次独立演化运行呈现一致的对称性方向。

  3. arXiv cs.RO

    ClimbLab:面向腿足攀爬机器人的 MATLAB 仿真平台

    ClimbLab 是一个开源的 MATLAB 仿真与分析平台,专为腿足攀爬机器人设计,可将任意肢体机器人系统建模为带浮动基座的铰接多体并进行行走与攀爬仿真。平台主要环境变量为倾角、重力和地面刚度,支持任意点云作为地形地图,并采用刚体动力学引擎。论文展示了四足机器人抓附墙面或攀爬陡坡的仿真示例。

  4. arXiv cs.RO

    geodex:面向黎曼流形的运动规划开源库

    geodex 是一个开源 C++20 库(含 Python 绑定),把流形、黎曼度量、retraction 与采样器拆成可互换组件,通过统一的基于采样的运动规划接口调用。同一规划器无需修改即可运行在 R^n、T^n、S^n、SO(2)、SE(2)、SO(3)、SE(3) 及其乘积空间和关节型机器人构型空间上,每个空间可配用户自定义黎曼度量。该库已公开,附带文档、测试与可复现基准套件。

  5. arXiv cs.RO

    DexUMI 外骨骼可穿戴接口几何差异如何影响触觉表征与操作策略

    DexUMI 系列外骨骼的两种手部几何版本在相同机器人指令定义、映射流程和触觉模块下,改进版降低了操作者体力需求,并在基线版机械受阻的精密抓取中实现触觉采集。在开盖和开鸡蛋盒任务中,改进版演示训练的策略成功率高于基线版,空间加力输入也优于二值聚合输入。

  6. arXiv cs.RO

    统一运动学表示实现可复用的生物关节力矩估计

    研究者提出以关节运动学作为中间表示,将硬件特定传感与下游生物关节力矩估计解耦,估计器仅用开源生物力学数据训练。在髋外骨骼、膝外骨骼和 IMU 三种运动学输入下,平地、上坡和下坡行走的 RMSE 分别为 0.17、0.19、0.15 Nm/kg,R² 分别为 0.79、0.62、0.85。该框架有望减少目标设备数据采集,支持外骨骼控制与可穿戴生物力学的可迁移力矩估计。

  7. arXiv cs.RO

    HULK:面向人形机器人的全身强力运动操作学习框架

    HULK 是一个面向人形机器人全身强力运动操作的全身控制框架,通过 MPC 引导强化学习并蒸馏出单一策略,在仿真和宇树(Unitree)G1 上完成评估。仿真中,带捕获点控制障碍函数的教师模型在每臂 10 kg 负载下取得最低前向与侧向速度跟踪误差,并将 DCM 偏移幅度较纯 MPC 引导强化学习降低 35.7%;腕力教师可承受最高 130 N 的躯干推力扰动。

  8. arXiv cs.RO

    Co²Skill:通过技能组合实现长时程人-环境交互的全身控制

    Co²Skill 提出统一策略框架,将全身场景交互与灵巧物体操作整合进同一控制公式,基于预训练运动先验,用任务与阶段相关的观测掩码选择当前交互目标所需信息。该方法引入目标条件 loco-manipulation 课程与跨任务课程,支持跨任务边界保持物理状态与抓取,实现顺序任务执行及场景交互与操作同步进行。研究在坐、站、攀爬、上下楼梯及目标导向操作等任务上完成评估,并展示室内环境中的技能组合。

  9. arXiv cs.RO

    面向地外自主异常分诊的证据驱动人-智能体-机器人协同架构

    研究提出一种证据驱动的人-智能体-机器人协同架构,用于深空乘组在地面支持缺失时的异常分诊:智能体 AI 作为有状态协调器管理假设、证据来源与不确定性,乘组侧具身智能体负责采集观察并解释评估变化,移动机器人获取局部证据。该架构在基于 Reachy Mini 与 Innate MARS 移动机器人的硬件在环集成原型中验证,并以 ISS 氨气误报和月球基地电源接口异常两个场景说明。

  10. arXiv cs.RO

    Ariadne:无需轨迹数据的流形引导轨迹规划方法

    研究者提出 Ariadne,通过学习状态空间流形并利用其几何结构进行轨迹规划,训练仅需状态观测、无需专家轨迹数据。在 Maze2D 与机器人运动规划基准上,该方法能从纯状态监督中构建可行路径,并泛化到未见过的起点-终点组合。在高维双臂规划任务中,Ariadne 无需轨迹数据训练即可与轨迹监督方法和经典规划器保持竞争力,论文已被 NeurIPS 2026 接收。

  11. arXiv cs.RO

    SAFE:用低成本声学感知统一检测机器人抓取中的滑动与破碎

    SAFE 用两个被动 PVDF 声学传感器加电机本体感知,无需视觉和先验材料知识即可实时检测滑动与破碎,在留一抓取交叉验证下取得 0.884 的 Alert-F1,且几乎不混淆滑动与破碎。基于该检测层的自适应抓取控制器在 Jetson Orin Nano 上以 104 Hz 运行,46 次闭环机器人试验成功率达 91.3%,对训练中未见的新物体成功率为 82.4%。

  12. arXiv cs.RO

    CIRRA:面向具身机器人交互式家务任务的双层持续指令协调框架

    CIRRA 是一个结合 LLM 语义推理与规则约束结构整合的双层框架,用于让机器人在执行任务中持续协调新指令,避免重新生成或大幅修改剩余任务序列。团队同时提出 CHIRP 基准,覆盖 8 类家庭环境和 6 类日常活动共 120 个回合,CIRRA 决策一致率达 74.2%,超出最强重规划基线 30 个百分点。

  13. arXiv cs.RO

    MimicX:面向视频驱动人形机器人运动跟踪的策略在环监督精修框架

    MimicX 是一个策略在环框架,利用执行反馈精修视频驱动的人形机器人运动跟踪,通过定位困难过渡与受影响身体区域,联合调整跟踪目标与重置课程。在四项核心视频任务上,其任务平均身体跟踪误差降低 25.7%,可稳健执行时长提升 255.6%。MimicX-HLoop 进一步通过异构执行加速反馈。

  14. arXiv cs.RO

    基于模型的强化学习实现液滴自主导航:零样本迁移与涌现动力学

    研究者推出首个在开放无约束表面上实现闭环自主液滴导航的机器人平台,采用基于模型的强化学习,仅需 50 至 150 次物理实验即可完成策略训练,无需仿真或解析模型。该平台可零样本迁移至未见几何表面,并能自主发现振荡脱钉策略以解除液滴卡滞,完整训练流程在 90 分钟内完成。

  15. arXiv cs.RO

    Robo-COP:让机器人编排器与策略在部署中共同进化

    Robo-COP 让 VLM 编排器与 VLA 策略在部署中共同进化,通过从自身执行中筛选技能演示、在数据能解决反复出现的失败时微调策略,并仅在新策略提升对应技能后才采纳。在十个 RoboLab 仿真任务上,平均留出成功率从冻结策略的 64.8% 提升至 73.8%,而固定计划微调无验证仅达 65.8%;在三个真实任务上从 38.3% 提升至 50.0%。

  16. arXiv cs.RO

    CERT-Replan:面向动态导航的自适应风险认证事件触发重规划

    CERT-Replan 通过在线校准障碍物预测残差、以校准后的障碍风险作为重规划预警信号,在风险超出预算时切换更低风险的规划模式而非反复修正原计划。在非平稳基准中,其碰撞率较仅用安全滤波器降低 83.3%、较简单重规划触发降低 77.8%,安全滤波器平均干预减少 32.4%;配合 Trajectron++ 实现 96% 无碰撞运行,硬件实验与板载运行时分析验证了计算可行性。

  17. arXiv cs.RO

    超越重建:机器人策略的动作 Tokenization 什么最重要?ProAct 提出可预测且鲁棒的动作分词方法

    ProAct 是一种策略无关的动作分词器训练方法,通过策略性增强重建目标来提升下游可预测性与鲁棒性,仅用动作数据集训练。在 Robomimic、LIBERO 和 RoboTwin 基准及多种分词器架构上,ProAct 将 rollout 成功率平均提升 11.3 个百分点;在 VLA 策略和真实机器人操作中分别平均提升 21.8 和 36.7 个百分点。

  18. arXiv cs.RO

    基于因子图与场景图的动态环境机器人世界模型综述

    这篇综述系统梳理了因子图与场景图两类机器人世界模型如何应对真实环境的动态性,围绕表示方法、构建与更新流程、下游任务利用三个维度展开,并重点关注将两者结合的混合模型。文章归纳了常见架构模式,指出不确定性传播、最小感知下动态实体运动与尺度的可观测性、可扩展的终身维护,以及缺乏将世界模型质量与动态下游任务表现挂钩的数据集和评测协议等开放挑战。

10月7日周三
  1. IEEE Spectrum · Robotics62

    Noitom Robotics 发布 HiPHI 大规模人体动作与物体交互数据集

    Noitom Robotics 发布 HiPHI,一个用光学动捕采集的 617.5 小时全身人体动作数据集,精度达亚毫米级,其中 245.7 小时为带同步物体轨迹与网格的人机物交互数据,并用 FrameNet 组织动作覆盖范围。白皮书同时提出用于衡量动作多样性与交互 grounding 的基准套件,并报告了在该数据集上训练的策略部署到实体 Unitree G1 人形机器人上的结果。

4月20日周一
  1. Berkeley AI Research42

    GRASP:面向世界模型长时程规划的梯度规划器

    Berkeley AI Research 提出梯度规划器 GRASP,通过将轨迹提升到虚拟状态实现跨时间并行优化、在状态迭代上直接注入随机性以探索、并重塑梯度让动作获得清晰信号,从而让基于学习世界模型的长时程规划变得可行。该方法针对长时程 rollout 中梯度爆炸/消失、非贪心结构导致的局部极小值以及高维视觉模型状态输入梯度脆弱等问题。