跳到正文
10月7日周三
  1. arXiv cs.RO 机器人学58

    Mulligan 提出面向机器人在机学习的性能引导数据采集方法

    Mulligan 将初始状态分布作为决策变量,每轮从已观察到的失败状态和未尝试状态开始采集,以提升固定监督采集预算下的数据效率。论文在 2,550 个盲测留出回合的三个真实任务和两个仿真任务上评估,相比均匀初始状态采样表现更好;结合基于价值函数的动作选择后,HiL-IDQL+Mulligan 在真实任务上最终成功率提升 10-34 个百分点。在操作员介入下,人机协作完成 98% 的采集回合。

    推荐理由:论文给出在固定采集预算下按失败状态分配初始状态分布的做法,做数据采集策略的团队可参考其对比设计。

  2. arXiv cs.RO 机器人学47

    面向欠驱动双足机器人的分层强化学习无碰撞运动控制

    该研究提出分层强化学习(HRL)框架,让欠驱动双足机器人在避障时保持平衡:高层策略基于机器人姿态、36 路 raycast 接近测量、移动障碍物状态与滚动时域局部目标,每 10 个控制步输出机体速度指令,底层策略以 PD 关节目标跟踪指令,两者用 Soft Actor-Critic(SAC)联合训练。

  3. arXiv cs.RO 机器人学55

    基于多目标强化学习的四足机器人无固定堆叠负载运输方法 PAMORT

    提出 PAMORT 多目标强化学习方法,让四足机器人在无专用负载传感器与主动承载机构的躯干安装无边板上运输无固定堆叠纸箱。该方法以偏好向量加权运动与负载稳定性奖励训练基础策略,再训练权重调节器依据本体感觉在线调整偏好,仿真中对未见过的三箱堆叠也取得与单目标基线相当或更优的运输成功率。

  4. arXiv cs.RO 机器人学56

    VLA 指令中的隐含危害:文本守卫漏检,机器人照样执行

    研究测试 VLA 安全监视器能否识别"任务无害但动机有害"的指令,发现 π0.5 在各种意图显式程度下均照常完成任务,与无害对照组无异。文本守卫几乎能拦下直白请求,却漏掉隐含危害:最高 95% 的隐含危害运行完成任务且未触发告警,重新校准后仍达 90%。监控模型激活也未能弥合差距,线性探针在基础语言与视觉-语言模型中近乎完美区分有害指令,但经机器人训练后该分离度在两个模型族中减弱。

  5. arXiv cs.RO 机器人学55

    面向非完整约束车辆的动态自适应走廊与可行性扰动信赖域 SQP 认证运动规划

    该规划器面向带倒挡的类车车辆,让优化每个迭代精确满足离散动力学并保证整车矩形在采样点之间不侵入障碍物,每个时间区间用一个凸走廊约束所有车角并以扫掠余量收缩。在 820 个基准用例中成功 818 个且无穿透(797 个来自首个初始猜测),7103 个优化迭代全部可用,当 99% 初始猜测与障碍物相交时成功率 96.5%。其机动中位时长比同类认证精确碰撞基线长 0.7%,保证仅适用于规划模型而非实车。

  6. arXiv cs.RO 机器人学53

    DASH:面向串联机械臂与人形机器人的 da Vinci 手术器械适配器,降低手术机器人研究门槛

    研究者提出 DASH,一种把 da Vinci Classic 与 Xi 手术器械适配到通用串联机械臂和人形机器人的适配器,无需改装器械本体。两类适配器兼容多种机器人负载能力,通过器械原生卡扣固定,并无线识别插入的工具以加载对应运动学与耦合矩阵。遥操作实验证实 DASH 可行,为手术机器人研究提供更易获取的平台。

  7. arXiv cs.RO 机器人学38

    Hybrid DeepSEE:面向可靠 Visual SLAM 的人在环神经符号漂移预判框架

    Hybrid DeepSEE(HDS)提出一种人在环(HITL)神经符号框架,用于 Visual SLAM 的主动漂移预判,将神经漂移风险估计与符号约束推理结合。框架利用 LLM 作为推理桥梁,把定性人类上下文转化为可解释的符号约束,以缓解数据驱动模型在 OOD 环境下输出物理不一致的问题。该方法旨在提升 Visual SLAM 的可靠性与一致性。

  8. arXiv cs.RO 机器人学56

    PHRetune:基于演示校准的端口哈密顿阻抗增益重调方法

    论文提出离线方法 PHRetune,为冻结的操作策略直接推导下游阻抗控制器的刚度与阻尼增益,无需评估回放或增益搜索。该方法从演示数据学习端口哈密顿模型,估算策略预测动作对应的 effort 与 energy 预算,并据此闭式求解单一增益缩放系数,在评估前固定增益,且不依赖机械臂模型、任务奖励、策略重训练或额外运行时计算。

  9. arXiv cs.RO 机器人学55

    The Unexpired Plan:为加速扩散策略提供免费监视器

    提出 The Unexpired Plan,用分块策略尚未过期的上一段规划作为免费统计量,为免训练加速的扩散策略提供监视器,在 114 种加速配置和四个策略族上以闭环成功率定价。相比每次拒绝后重新武装的门控,吸收式响应仅损失 1 分,将单次调用计算量削减 1.55–3.09 倍。在接触密集的第五个策略族上,无监视器方案均无法守住 ±2 分边界,带监视器方案可以。

  10. arXiv cs.RO 机器人学56

    FreeSpeed 提出免训练的生成式机器人策略执行速度控制方法

    FreeSpeed 是一种免训练模块,对预训练策略输出的动作块按请求速率重采样,并以相邻动作的方向不一致度作为信号自适应缩放步长,从而在保持任务成功率的前提下在线调节执行速度。在三个策略族、50 个仿真任务上,保持各任务成功率的设置中实际执行速率为 0.22x 到 2.53x;在四个真实操作任务上平均成功率 94.0%,与冻结策略的 93.8% 相当,实际执行速率为 0.38x 到 1.97x。

  11. arXiv cs.RO 机器人学47

    面向不确定环境下柔顺抓取的虚拟模型控制

    研究提出六种虚拟模型设计方法,用于力控机械臂在含障碍与不确定性的环境中完成抓取任务。在一台力控 8 自由度人形机器人上开展三项实验,测试可预测性、对外力的敏感度以及对已知和未知障碍的适应性。结果显示该方法虽牺牲精度与轨迹最优性,但能以直观、可扩展的方式设计复杂抓取动作。

  12. arXiv cs.RO 机器人学38

    基于扩散模型组合的航天器交会轨迹生成与模块化约束

    研究提出一种基于能量扩散模型组合的航天器交会与近距离操作(RPO)轨迹生成方法,可灵活配置任务约束。针对接近锥、传感器视线等约束分别训练扩散模型,推理时将学习到的能量模型与解析能量场组合以施加约束组合。实验中接近锥与传感器视线模型、接近锥与合成避障模型的组合,约束满足率与单约束模型相差在 1 个百分点以内或更高,无需重训即可适配新约束组合。

  13. arXiv cs.RO 机器人学50

    FOCUS:面向不确定性感知半静态场景的细粒度开放词汇变化检测

    FOCUS 提出一种不确定性感知的物体级变化检测与地图维护框架,将半静态记忆维护建模为融合几何似然与 3D Gaussian 地图渲染外观似然的概率推断,用递归三态估计器判定物体为 PERSISTED、REPLACED 或 REMOVED。在含歧义原位替换的 Isaac Sim 仓库基准与真实 TorWIC 数据集上,物体级替换 F1 从 0.20 提升到 0.84,且迁移到真实数据无需手动调参。

  14. arXiv cs.RO 机器人学47

    差速移动机器人的紧急避障机动研究

    研究通过 540 次瓷砖地面随机试验(保留 539 次),在 45、55、65 cm/s 指令接近速度下评估差速移动机器人的 5 种制动与转向机动。结果显示,反向旋转机动的编码器航向误差随速度从最低升至最高增加 4.7-5.1 度,而弧线与制动辅助枢转变化小于 0.4 度,陀螺仪误差在反向旋转中约 3 度。编码器误差越大,避障成功率越低,研究据此给出 90% 成功率的估计反应距离。

  15. arXiv cs.RO 机器人学45

    构建自动驾驶研究用多传感器平台:挑战与经验教训

    一篇自动驾驶研究论文总结了开发和部署灵活多传感器数据采集平台时遇到的挑战与经验,涵盖机械设计、传感器标定、电源管理和时间同步等共性问题。团队采用 GNSS 授时与 NTP 协议实现系统级时间同步,并针对不同传感器配置编写自定义标定流程,以提升外场部署的可靠性与数据完整性。论文旨在为新建多传感器系统的研究团队提供参考,增强自动驾驶测试的可复现性与鲁棒性。

  16. arXiv cs.RO 机器人学49

    TacGELLO:为 3D 打印遥操作主手提供触觉接触反馈

    TacGELLO 利用 3D 打印主手已有的舵机,在夹爪扳机处提供触觉接触反馈,并在臂关节处提供基于电流的负载提示。AnySkin 接触检测触发扳机位置保持,跟随臂关节电流变化调整主手舵机输出限值以在抬升时产生阻力。在一名操作者完成的 6 次 UR3 会话中,发送指令跟踪误差为 0.15–0.36° RMSE,轨迹滞后 82–98 ms,62 个抓取区间中有 60 个记录到触觉触发。

  17. arXiv cs.RO 机器人学47

    GR-LIO:基于机身-地面高度的局部地面感知 LiDAR-惯性里程计系统

    GR-LIO 提出一种滤波式局部地面感知 LiDAR-惯性里程计框架,将局部地面平面以机器人姿态和机身-地面(B-G)高度参数化并随状态估计持续传播,用于高效地面分割与点到面约束更新。系统引入平面运动更新抑制垂直漂移,并提供 B-G 高度初始化与在线标定流程。在公开基准与自采真实数据集上,GR-LIO 在定位精度和计算效率上均优于代表性 LIO 方法。

  18. arXiv cs.RO 机器人学47

    Neural Barriers:面向安全关键控制的在线可认证学习增强自适应高阶控制屏障函数方法

    提出一种可认证的在线学习增强鲁棒自适应控制屏障函数,用 Neural ODE 适应未知时变模型扰动,并以 conformal prediction 量化自适应不确定性。在适定 Lipschitz 光滑性假设下,该方法在概率界内提供可证明的安全保证,不确定性高时采取保守策略,随数据增多降低控制器保守性,适用于载荷或风扰等模型扰动下的机器人系统。

  19. arXiv cs.RO 机器人学47

    基于序列多线索融合与 Sim-to-Real 自训练的鲁棒手术机器人器械跟踪

    提出 tracker-guided 自训练框架,将合成图像预训练模型适配到无标注真实视频,用于手术机器人器械跟踪。不确定性感知 EKF 结合关键点、轴边界与 mask 线索递归修正器械位姿,RTS 平滑器细化轨迹并生成伪标签微调特征检测器。真实视频实验显示自训练在所有关键点指标上一致提升,精度与运行时均优于既有方法,代码与数据将在发表后发布。

  20. arXiv cs.RO 机器人学38

    导览机器人的社会导航力模型

    研究者提出一种基于社会力的导览机器人导航模型,将障碍物、用户位置与朝向等因素纳入力的计算,使机器人对用户更"社会化"。实验中用户跟随自主机器人在已知地图中前往目的地,中途执行简单子任务作为干扰,并与 A* 最短路径基线对比。研究通过可跟随性、感知安全与感知智能等主观指标评估各力项的效果。

  21. arXiv cs.RO 机器人学53

    RMMBench:面向机器人移动操作的综合评测基准

    RMMBench 提出一个统一框架,将高低层级具身任务整合为"导航-操作"任务套件,覆盖 70 个典型任务场景,从局部操作延伸到长时程复合导航,用于评估 VLM 在连续空间中理解语言指令并执行长时程任务的能力。评测结果显示,领先 VLM 在移动操作任务的空间定位上仍面临重大挑战,凸显长时程交互中增强机器人空间感知能力的必要性。该基准已被 CoRL 2026 接收。

  22. arXiv cs.RO 机器人学52

    在未建模状态依赖下使用学习型 Critic 的最优控制

    该框架用残差动力学网络补全名义解析模型缺失的状态依赖效应,并以学习型动作价值 Critic 将长时域 MDP 结构注入局部 iLQR 优化。配套的 GPU 加速批量 iLQR 求解器可在最优控制回路内评估学习网络,并行求解数千条轨迹优化问题。在有偏且未完整建模的控制任务上,闭环控制性能得到提升,同时保留了约束轨迹优化所需的模型结构。

  23. arXiv cs.RO 机器人学55

    VAMPS:基于采样规划的视觉与运动策略学习框架

    VAMPS 提出用 MPPI 控制训练可复用机器人策略,无需人类示教,支持仿真迭代训练与真实机器人数据直接训练两种模式。仿真模式下策略热启动 MPPI 并用 IQL critic 更新,学到的运动策略迁移到 Unitree Go2;真实模式在 Flexiv Rizon 10S 上用 Action Chunking with Transformers 离线训练,完成抓取放置与力感知白板擦拭。

  24. arXiv cs.RO 机器人学55

    CoDance:从视频学习人形机器人反应式柔顺双人舞蹈交互

    CoDance 提出一个从视频学习反应式、柔顺人机人形交互的框架,以双人舞蹈为场景,让机器人与移动伙伴协调步伐并保持双手持续接触。给定一段双人舞视频,CoDance 将动作重定向为机器人参考与移动伙伴,并引入多连杆柔顺增强方法,在双手施加结构化力把运动学演示转化为力感知训练数据。

  25. arXiv cs.RO 机器人学47

    Safe Ergodic Control for Multi-Robot Systems via Quadratic Programming:基于二次规划的多机器人安全遍历控制

    论文提出一种基于二次规划(QP)的多机器人安全遍历(ergodic)控制器,将遍历性与安全性联合求解,取代依赖离线轨迹优化或分层架构的现有方法。该方法引入时间可微的高斯核遍历度量,将其指数衰减作为时变控制屏障函数(CBF)约束,并与区域包含、机器人间避碰的硬 CBF 约束并列,同时证明 QP 从任意安全初始配置均可行。仿真性能优于基线方法,并在三架飞行器上完成真机验证。