跳到正文
今天10月8日周四177 条
  1. arXiv cs.RO 机器人学50

    平滑隐式接触动力学的安全关键控制

    一篇被 Robotics and Automation Letters (RA-L) 接收的论文为平滑隐式接触动力学提出安全滤波框架,通过一阶 Taylor 近似推导离散时间控制障碍函数(CBF)约束,并引入边界聚焦 rollout 筛选平滑参数 κ、以固定裕度收紧预测约束。四个接触丰富系统的仿真表明,该方法消除了标准 CBF 下观测到的力约束违反。

  2. arXiv cs.RO 机器人学55

    NovaPlan:基于闭环视频语言规划的零样本长时域机器人操作框架

    NovaPlan 是一个分层框架,通过系统性地提出、验证和修复视觉计划,实现鲁棒的零样本长时域操作。高层由 VLM 规划器分解任务,并通过验证多个候选视频回滚过滤动力学不一致的未来;执行中采用在物体中心流与人手流之间自适应切换的混合几何表示,并持续监控执行、在失败时合成指尖轻戳等局部非抓取纠正行为。

  3. arXiv cs.RO 机器人学58

    RoboFAC:面向机器人操作失败分析与纠正的框架

    RoboFAC 提出一个面向 VLA 模型失败诊断与恢复的框架,构建了含 9,440 条错误操作轨迹、78,623 个 QA 对、覆盖 53 个仿真与真实场景的失败数据集,并训练出可本地部署的轻量多模态模型。实验显示其失败分析准确率比 GPT-4o 高 34.1%,作为外部监督器接入真实 VLA 控制流程后在四项任务上带来 29.1% 的相对提升,且延迟显著低于 GPT-4o;模型与数据集已公开。

  4. arXiv cs.RO 机器人学66

    RoboJEPA:面向多本体机器人世界模型的扩展律研究

    论文提出基于 JEPA 的机器人世界模型 RoboJEPA,在覆盖 12 种机器人本体的大规模真实机器人数据集上训练,其想象误差(latent rollout 误差)随算力呈二阶幂律,可在拟合规模之外预测模型质量。

    推荐理由:论文给出想象误差随算力的二阶幂律,为评估多本体世界模型规模提供了可迁移的预测方法。

  5. arXiv cs.RO 机器人学55

    SQAM:用标量伴随匹配实现流策略的 Q-Learning 微调

    论文提出 Q-learning with Scalar Adjoint Matching(SQAM),针对流策略经多步流生成动作、用离线 RL 微调时每步需向量-雅可比乘积且成本随流步数与策略规模增长的问题,观察到预训练流策略的批量平均速度雅可比集中在对角线上,据此推导出按流时间缩放最终动作价值梯度的闭式标量伴随,消除逐步向量-雅可比乘积,并在策略生成动作上加入价值惩罚。

  6. arXiv cs.RO 机器人学53

    Rubix:基于排列几何的无对应全局点集对齐方法

    论文提出 Rubix,在平方欧氏损失下全局求解等权平面点集对齐问题,无需给定对应关系。每个匹配对应一个复相关,其凸包构成排列多边形,最远顶点给出全局对齐;作者证明 n≥2 时顶点数紧界为 n(n-1),回答了 Rote 的旋转分配公开问题,精确算术下以 O(n^5) 次操作恢复该多边形。

  7. arXiv cs.RO 机器人学47

    时间可解释的可微决策树(DDT):用动作分块提升序贯决策的可解释性

    研究提出"时间可解释性"概念,通过动作分块(action chunking)改进可微决策树(DDT)在序贯决策任务中的表现,并给出两种融入动作分块的策略梯度算法与一种信息论树重构算法。在四个仿真环境中,从蒸馏的动作分块策略热启动得到的 DDT 效果最佳:在四个领域中的三个上匹配神经网络策略的性能,参数量最多减少 80%。代码已开源。

  8. arXiv cs.RO 机器人学45

    RLHF 用于人机协作的范围综述与实验研究

    一项针对人机协作(HRC)中 RLHF 的范围综述筛选 199 条记录并纳入 20 篇 2020-2025 年同行评审文献,作者称其为首个聚焦 RLHF 双向闭环设计的综述。随后开展的 VR 被试间实验用贝叶斯模型分析系统发起与用户发起反馈对机器人近端行为安全导航的影响,结果显示用户发起反馈能更好地捕捉感知安全,表明反馈时机直接影响反馈质量。

  9. arXiv cs.RO 机器人学45

    超越策略支持:面向自动驾驶的交互约束离线强化学习框架 ICDP

    研究提出离线强化学习框架 Interaction-Constrained Drive Policy(ICDP),显式控制自动驾驶中的交互分布偏移(IDS),将联合支持退化精确分解为自车支持分量与残余交互支持分量,并通过对比密度比估计恢复后者,无需显式联合密度建模、周围智能体预测或在反应式仿真器中 rollout。

  10. arXiv cs.RO 机器人学51

    MeshSIPP:动态环境下高效的时空格点路径规划

    论文提出 MeshSIPP,一种面向动态环境下非完整约束轨迹规划的高效算法,通过将运动原语作为空间束传播、用轻量包围区间检查筛选,并把昂贵的精确出发时间搜索推迟到原语到达终态时,来消除计算瓶颈;另加时间感知剪枝规则提前丢弃冗余时空分支。作者证明该搜索具备完备性与最优性,在超过 6,000 个基准实例和 ROS 2 实时仿真中,MeshSIPP 相比最先进的时空规划器最高获得 3× 加速。

  11. arXiv cs.RO 机器人学44

    面向长期 LLM Agent 的情境条件化思考策略学习

    论文提出情境条件化思考记忆框架,将历史推理经验转化为预测当前情境应思考内容的轻量策略,把详细推理留给大语言模型。实验显示该策略在时间规则泛化上达到 1.000 F1,将 DeepSeek 推理 F1 从 0.789 提升至 0.868,在 30,000 条历史情境下把单次查询在线处理时间从 0.3636 ms 降至 0.0382 ms。

  12. arXiv cs.RO 机器人学47

    ActiveLang:语义不确定性引导探索的主动开放词汇 3D 地图构建

    ActiveLang 提出一种主动开放词汇 3D 地图构建系统,通过语义不确定性引导探索,在紧凑的双 Gaussian 表示上在线适配语言特征,联合重建场景几何、外观与开放词汇语义,内存开销较小。其规划器高效选取信息量高的视点,用更少观测和更低计算成本完成建图。在 Replica 和 ScanNet++ 上的实验显示,其 2D 与 3D 开放词汇分割效果相比在线与离线基线均有明显提升。

  13. arXiv cs.RO 机器人学55

    Kuration SDK:用数据策展弥合虚拟到现实差距

    论文提出面向物理 AI 数据策展的通用工具 Kuration SDK,并随论文开源。作者在 CounterStrike 游戏数据上训练和评估扩散世界模型,确认可玩性与 FVD、LPIPS、JEDi 等指标并不对应,将其称为 Virtual2Real gap;Kuration SDK 帮助定位了两个 LPIPS 和 FVD 分数接近、但实际表现差异很大的世界模型的根因。

  14. arXiv cs.RO 机器人学42

    LeCuration:用小型世界模型做数据筛选的多面工具

    LeCuration 是一个以 LeWorldModel(LeWM)为潜在编码器与预测器、并加入 diffusion transformer(DiT)解码器的小型世界模型,用作面向更大下游模型的数据筛选工具。其嵌入可作为异常检测信号和基于内容的聚类启发式,自回归预测游戏状态可定性检查动作-状态一致性。论文给出 CS:GO 游戏数据的概念验证案例,尚未报告定量筛选指标与下游训练结果。

  15. arXiv cs.RO 机器人学50

    目标条件策略学习中的"视界信息诅咒"

    研究在目标条件策略学习中识别出一种"视界信息诅咒":增大目标重标注视界会显著削弱策略泛化与性能,即便测试时只评估邻近子目标序列,行为克隆(BC)策略仍出现严重的、依赖训练视界的性能退化,而强化学习(RL)目标可缓解该现象。作者将其解释为动作与事后重标注目标之间条件互信息随视界下降,并发现将短视界策略的输入 Jacobian 蒸馏到长视界策略可在组合操作任务上带来显著性能提升。

  16. arXiv cs.RO 机器人学45

    StableGrasp:从单张图像重建物理稳定的仿人手抓取

    StableGrasp 提出一个基于可微仿真的优化框架,从单张 RGB 图像重建物理稳定的仿人手抓取,将视觉手部姿态与决定抓取力的控制目标显式分离。该方法在可微仿真器中通过最小化抓取动能联合优化手部几何与控制,并对手部几何施加正则以保持视觉一致性与几何合理性。实验显示其重建的抓取在严格物理仿真下比其他手-控制策略稳定得多。

  17. arXiv cs.RO 机器人学38

    单步带标签令牌路由问题的复杂性研究

    论文研究了受中性原子量子计算机原子搬运启发的单步带标签令牌路由问题的计算复杂性。研究证明该问题在最大度为四的平面网格图上即使存在边不相交路径的解仍为 NP-complete,在最大度为三的树上按解边重数参数化为 W[1]-hard,且在候选边重数不超过八的树上仍为 NP-complete。同时证明该问题在树上按最大度与候选边重数(或候选顶点重数)联合参数化时是固定参数可解的。

  18. arXiv cs.RO 机器人学41

    基于异构图神经网络的多智能体路径规划共享路图生成与评估

    论文提出一种可扩展的异构图神经网络(GNN)框架,用于自动生成和评估多智能体共享路图,将路径点、智能体位置和任务位置表示为异构图中的不同节点。模型在专家求解器轨迹聚合的占据密度图上训练,学习识别关键兴趣点并剪除冗余节点与边,生成紧凑、协调感知且对任务排列不变的路图。实验显示该框架在稠密路图上可将运行时间和图规模至少降低 40%。

  19. arXiv cs.RO 机器人学45

    LASER:面向支撑约束熵正则化离线强化学习的隐空间伴随匹配算法

    LASER 提出一种离线强化学习算法,通过隐空间伴随匹配实现熵正则化的隐空间强化学习,在保持表达性流策略的同时避免通过时间反向传播。在 40 项不同数据集质量的 OGBench 任务上,LASER 取得 state-of-the-art 性能,且在所有任务上使用固定的、与任务无关的超参数,优于包括按任务和数据集专门调参的基线方法。该论文已被 NeurIPS 2026 接收。

  20. arXiv cs.RO 机器人学51

    FlightMagNav:面向户外磁场定位的开放数据集与概率地图学习验证框架

    论文提出 FlightMagNav,一个面向近地飞行平台磁场定位研究的开放数据集,数据由搭载两台光泵磁力计(量子磁力计)和 GNSS 辅助惯性导航系统的无人机采集,包含磁场地图学习与验证两部分测量。随数据集一并发布了概率式磁场地图学习与验证框架,并用其演示数据集的用法,最后展望了可基于该数据集展开的研究方向。

  21. arXiv cs.RO 机器人学53

    分解式触觉表示与控制框架实现小于 1 mm 接触定位与 35% 插孔成功率提升

    论文提出一种分解式触觉表示与控制框架,将法向力与接触斑映射为可从传感器读数恢复的有效接触响应,并把响应分解为接触几何、力分布和时变接触三部分分别编码与随机化,Tactile Gated Policy 在控制中保留这些表示且无需重训练即可覆盖所有掩码配置。