跳到正文
10月7日周三
  1. arXiv cs.RO 机器人学52

    在未建模状态依赖下使用学习型 Critic 的最优控制

    该框架用残差动力学网络补全名义解析模型缺失的状态依赖效应,并以学习型动作价值 Critic 将长时域 MDP 结构注入局部 iLQR 优化。配套的 GPU 加速批量 iLQR 求解器可在最优控制回路内评估学习网络,并行求解数千条轨迹优化问题。在有偏且未完整建模的控制任务上,闭环控制性能得到提升,同时保留了约束轨迹优化所需的模型结构。

  2. arXiv cs.RO 机器人学55

    VAMPS:基于采样规划的视觉与运动策略学习框架

    VAMPS 提出用 MPPI 控制训练可复用机器人策略,无需人类示教,支持仿真迭代训练与真实机器人数据直接训练两种模式。仿真模式下策略热启动 MPPI 并用 IQL critic 更新,学到的运动策略迁移到 Unitree Go2;真实模式在 Flexiv Rizon 10S 上用 Action Chunking with Transformers 离线训练,完成抓取放置与力感知白板擦拭。

  3. arXiv cs.RO 机器人学55

    CoDance:从视频学习人形机器人反应式柔顺双人舞蹈交互

    CoDance 提出一个从视频学习反应式、柔顺人机人形交互的框架,以双人舞蹈为场景,让机器人与移动伙伴协调步伐并保持双手持续接触。给定一段双人舞视频,CoDance 将动作重定向为机器人参考与移动伙伴,并引入多连杆柔顺增强方法,在双手施加结构化力把运动学演示转化为力感知训练数据。

  4. arXiv cs.RO 机器人学47

    Safe Ergodic Control for Multi-Robot Systems via Quadratic Programming:基于二次规划的多机器人安全遍历控制

    论文提出一种基于二次规划(QP)的多机器人安全遍历(ergodic)控制器,将遍历性与安全性联合求解,取代依赖离线轨迹优化或分层架构的现有方法。该方法引入时间可微的高斯核遍历度量,将其指数衰减作为时变控制屏障函数(CBF)约束,并与区域包含、机器人间避碰的硬 CBF 约束并列,同时证明 QP 从任意安全初始配置均可行。仿真性能优于基线方法,并在三架飞行器上完成真机验证。

  5. arXiv cs.RO 机器人学45

    基于数字孪生的 AR 遥操作接口用于灵巧操作:Now You Feel It, Now You See Me

    提出一种基于数字孪生的 AR 遥操作接口,融合裸手追踪、双手机器手与机器人/任务物体的虚拟表示,用于灵巧操作演示采集。接口将触觉测量渲染到机器人手网格上形成视-力反馈,并提供用户可控虚拟视角面板或遮挡感知透明渲染以缓解遮挡。通过 Task 1 与 Task 2 用户研究评估力可视化与视觉辅助在精细力控和遮挡操作任务中的作用。

  6. arXiv cs.RO 机器人学55

    FreeLoc:基于扩散辅助位姿精化的在线平面图定位框架

    FreeLoc 提出一种在线 RGB 平面图定位框架,将平面图作为可直接查询的几何地图,通过即时射线查询检索候选位姿锚点并用扩散辅助精化得到连续位姿估计。其在线似然构建策略支持基于直方图滤波的时序融合,无需离线数据库。实验显示单帧与序列定位均达 state-of-the-art 并实现实时在线推理,真实场景验证了室内机器人定位的可部署性。

  7. arXiv cs.RO 机器人学53

    RobotUse:分配计算、上下文与决策的机器人智能体框架

    机器人智能体框架 RobotUse 在 RoboLab 上取得 45% 任务成功率,较 CaP-X 高出 6.7 个百分点,同时保持紧凑的决策上下文。智能体通过视觉选择目标与位姿,后端负责几何、运动规划与控制,子智能体在各子目标内保留详细交互信息供后续决策使用。该框架通过更新持久化 playbook 从真实执行中学习,并将所学迁移到后续任务。

  8. arXiv cs.RO 机器人学45

    PreAct-Nav:面向城市导航的行动前智能体推理框架

    PreAct-Nav 提出一种智能体导航框架,为冻结策略加入预期推理以实现稳健的城市导航。框架以导航记忆模块维护中程子目标与经验,并用动作条件世界模型 AC-WM 预测候选动作后果,由视觉语言模型 VLM 推理器据此保留或修正动作。评测显示该方法通过记忆更新与视觉预测改善动作选择,在更长、转弯更多的路线上增益更明显。

  9. arXiv cs.RO 机器人学54

    通过基于采样的扰动观测器应对 Sim-to-Real 失配:从解析模型到学习型世界模型

    研究提出基于采样的扰动观测器 SDOB,将扰动观测器原理从显式被控对象模型扩展到仿真器与学习型世界模型,通过状态回放或代价查询接口估计未测量扰动。SDOB 区分状态效应扰动与代价扰动两类可观测通道。仿真与真机实验表明其可补偿 Sim-to-Real 失配并改善控制性能。

  10. arXiv cs.RO 机器人学40

    基于软触觉传感器的多机器人系统分布式级联力控制用于物体搬运

    提出分布式级联力控制(DCFC),使配备 360 度视觉软触觉传感器的多机器人在无机器人间通信下协同推动刚体朝移动目标方向运动。内环融合接触力与定位,外环协调推力方向,对未知物体质量具有鲁棒性,并用 Lyapunov 稳定性理论验证收敛性。仿真与真实实验验证了多机器人协同推动效果,成果发表于 2024 IEEE/SICE SII。

  11. arXiv cs.RO 机器人学47

    流策略作为技能级世界模型的动作:面向长时程规划的学习与符号抽象

    研究者用 flow-matching 策略的输入构造技能级动作,使一次完整技能执行对应一次世界模型转移,并提出压缩种子、两种从演示学习的离散码和符号标签四种动作抽象。在需最多 14 个顺序技能的模拟积木重排任务中,符号标签在最多六个技能的任务上成功率超 90%,无标签的物体中心学习码在单技能任务上与之相当。消融显示标签优势主要来自规划器知晓动作适用性,超过六个技能后限制成功率的是搜索而非世界模型。

  12. arXiv cs.RO 机器人学47

    DNPush:多机器人系统无通信非平行推力控制实现物体搬运

    DNPush 提出一种分布式非平行推力控制器,使多机器人在无机器人间通信、无需物体模型与质心估计的条件下协同搬运物体。控制器依据本地力方向偏差按 reciprocal-sine 律调节非平行力幅值,Lyapunov 分析证明系统收敛到唯一旋转平衡点,物体速度收敛至期望搬运方向。

  13. arXiv cs.RO 机器人学47

    LLM 机器人团队中的隐蔽内部攻击:少说谎、说大谎

    研究提出针对 LLM 机器人团队的隐蔽内部攻击模型:单个被攻陷机器人在多机器人测绘任务中,受限于团队检测器而非能量预算。推导出两个界——攻击报告被验证概率的下界(取决于通信图度数与验证预算),以及线性规划给出的地图误差上界,揭示"少说谎、说大谎"的最优攻击策略。实验中诚实机器人为 LLM agent,两个界在攻击实际花费的预算处均成立,且 LLM 复查记录的选择无偏但复查量不可预测。

  14. arXiv cs.RO 机器人学55

    用视觉预测力替代力传感器实现接触密集机器人操作

    研究提出通过柔性 Fin Ray 夹爪的形变进行视觉力预测,实现无需力或触觉传感器的力感知操作。方法先在标定数据上训练视觉力估计器为演示标注力,再训练动作-力联合生成策略,测试时选取预测力最接近目标的候选动作。在摘莓、抓空罐、手内重定向和插头插入任务上验证了可行性。

  15. arXiv cs.RO 机器人学45

    全驱动多旋翼通过最小化齐次分配代价产生欠驱动行为

    研究表明,全驱动多旋翼在仅给定位置轨迹时,最小化正齐次分配代价(含标准最小范数伪逆分配)会选出欠驱动式行为。通过 fiberwise infimization 将执行器输出代价映射到 wrench 空间,得到齐次下确界分配代价,并推导出精确最优性间隙分解。扰动或运动改变力方向时,全驱动平台可立即用横向权限生成新力并转向新最小代价族,而结构欠驱动平台须先转向,因此全驱动价值在于抗扰与瞬态力生成。

  16. arXiv cs.RO 机器人学55

    TTT-RM:将 Test-Time Training 作为机器人策略的残差记忆

    TTT-RM 将 Test-Time Training 重构为残差记忆,用快速权重补充有界记忆库,保留当前上下文无法恢复的任务相关历史信息。该方法学习历史解码器,以重建残差作为 TTT 慢权重优化目标,使在线快速权重更新编码互补历史。在记忆密集型仿真基准与真实任务上,TTT-RM 在多种记忆设计中一致提升,支持三分钟八阶段收纳任务的持续执行。

  17. arXiv cs.RO 机器人学49

    PerturBot:用扰动训练打破视觉-语言-动作模型的捷径先验

    PerturBot 通过任务保持的腕部视角扰动、决策相关字幕增强指令,以及随机与失败轨迹片段重标注,削弱视觉-语言-动作(VLA)策略对模态捷径的依赖,且不改变推理过程。配套提出的 GroundingFscore 是一种离线评分,用于诊断策略对模态捷径的依赖程度,与任务成功率结合可判断策略是否健康扩展。

  18. arXiv cs.RO 机器人学52

    基于可微有限元的气动软体机器人端到端建模框架

    一个端到端可微有限元(FEM)框架将 CAD 自动转换为体素化四面体黏弹性网格,用于气动软体机器人建模与系统辨识。结合点云数据,该框架以最小实验装置辨识材料与动态驱动参数,并利用梯度完成轨迹优化。在波纹管式气动软体机器人上验证,最大位置误差小于 3 mm,可用于路径跟随与抓取任务。

  19. arXiv cs.RO 机器人学43

    利用分层控制器结构进行人形机器人移动操作的上下文参数学习

    提出一种上下文贝叶斯优化框架,用于分层控制系统中质心预测控制器与全身控制器的联合参数学习,保留任务性能、实现质量与控制努力的独立观测,并用相关多输出高斯过程建模。在不同箱体质量下的人形机器人推箱移动操作任务中,该方法在训练与适应阶段均取得所比较基线中最低的平均经验遗憾。

  20. arXiv cs.RO 机器人学55

    RiskFly:面向动态杂乱环境单阶段敏捷飞行的视锥对齐时空风险场

    RiskFly 提出一种单阶段规划器,用视锥对齐的时空风险场预测危险出现的位置与时间,替代仅输出标量轨迹代价的编码信号。双流观测将短深度序列与倒球面距离图序列配对,辅助头回归由特权最近接近点(CPA)目标监督的风险场,并沿五次轨迹可微查询。仿真与零样本真实飞行显示,在资源受限平台上成功率更高且端到端时延相当。

  21. arXiv cs.RO 机器人学43

    利用低成本机器人开展 K-12 STEM 教育:Jar Jar ROV 水质监测实践

    Jar Jar ROV 是面向中学生公民科学水质监测的低成本开源遥控潜水器(ROV)平台,已在某州 100 多名学生中大规模部署,学生自行搭建、编程并在当地湖泊投放。项目收集了近 1.1 万条经验证的温度、pH、溶解氧和浊度测量数据,ROV 搭建环节获导师满分评价。评估发现电子组装和数据上传等复杂任务中学生参与度明显下滑,论文据此提出降低技术门槛的改进路线。

  22. arXiv cs.RO 机器人学47

    基于联合优化的雷达-LiDAR-相机在线无目标外参标定方法

    提出一种雷达-LiDAR-相机在线无目标外参联合标定框架,为每对传感器构建残差并整体优化全部外参,避免两两标定结果跨三传感器不一致。框架引入基于距离相关裕度的自适应雷达噪声滤波器剔除虚假回波,并通过跨帧累积聚合稀疏雷达对应点。在覆盖多种城市环境的自采雷达-LiDAR-相机数据集上,该方法在所有传感器对上的标定误差均优于先进的相机-LiDAR 基线。

  23. arXiv cs.RO 机器人学41

    NM-LIO:应对 LiDAR 测量噪声差异的多 LiDAR 惯性里程计

    NM-LIO 提出噪声感知的多 LiDAR 惯性里程计方法,通过集成噪声模型量化每个 LiDAR 的测量噪声,并基于测量噪声估计残差不确定性,使测量模型能捕捉不同 LiDAR 间的噪声差异。该方法在公开多 LiDAR 数据集上与最新方法对比,实验结果表明其能在多种环境中准确估计里程计。论文发表于 RiTA 2024。