跳到正文
今天10月8日周四9 条
  1. 雷锋网64

    银河通用与清华 LATENT:用不完美人类数据让 Unitree G1 学会网球对打

    IROS 2026 上,银河通用 GaLbot 团队与清华大学、北京大学、上海启智研究院和上海人工智能实验室提出 LATENT,让 Unitree G1 从 5 名业余球员在 3米×5米区域采集的约 5 小时不完美动作数据中学习网球能力。

    推荐理由:文中给出成功率、消融和真机限定条件,读者可据此判断该方法的真实能力边界。

  2. 雷锋网60

    研究了1933篇 IROS 2026 论文,我们看到了机器人学的六项新变化

    文章对 IROS 2026 进入正式议程的 1933 篇论文做多标签梳理,Robot Learning / Embodied AI 约 809 篇、Navigation / Planning 564 篇、Humanoid / Legged 约 213 篦,指出大模型并没有吃掉机器人学,学习、感知、规划、控制与操作正深度交织。

    推荐理由:对1933篇论文的多标签统计给出了各方向的篇数与交叉数据,可据此判断机器人研究的真实重心分布。

  3. arXiv cs.RO 机器人学57

    HuMBLE:基于人体运动数据的人形机器人步态行为学习框架

    HuMBLE 提出一种学习框架,从人体运动数据合成可实时操控、鲁棒且拟人的人形机器人步态策略。方法先用强化学习训练全身参考条件策略,再经师生蒸馏得到仅依赖本体感知和平面躯干速度指令的轻量先验策略,随后用多任务强化学习微调,以目标条件任务扩展指令覆盖并用参考引导任务作为风格正则。

  4. arXiv cs.RO 机器人学55

    HULK:面向人形机器人全身用力 loco-manipulation 的控制框架

    论文提出 HULK 全身控制框架,用 MPC 预测负载动力学引导强化学习,训练两个教师策略(腕力下跟踪手臂动作、抱持大物体行走),再蒸馏为单一策略,并在仿真与 Unitree G1 上评测。仿真中带屏障函数的教师在每臂 10 kg 负载下前向与横向速度跟踪误差最低,DCM 偏移总量较仅用 MPC 引导强化学习降低 35.7%,腕力教师可承受高达 130 N 的躯干推扰。

  5. IEEE Spectrum · Robotics57

    HiPHI:面向人形机器人大规模高精度人体动作与物体交互数据集白皮书

    IEEE Spectrum 与 Wiley 联合发布由 Noitom Robotics 赞助的白皮书,介绍 HiPHI 数据集:617.5 小时光学动作捕捉的全身人体动作数据,亚毫米级精度,其中 245.7 小时为人与物体交互数据,含同步物体轨迹与网格,并用 FrameNet 语言框架组织动作覆盖范围。

    推荐理由:白皮书给出了数据集规模与人机交互数据的组织方式,关注人形机器人数据来源的读者可据此评估其补充价值。

10月7日周三
  1. arXiv cs.RO 机器人学28

    KungfuAthleteBot:从视频学习高动态人形机器人动作与统一跌倒恢复

    KungfuAthleteBot(KAB)框架在人形机器人上从视频学会高动态技能,并在约 0.7 s 内从任意跌倒中恢复,是已报道的统一策略中最快的恢复速度。该框架构建了由国家级武术运动员视频组成的 KungfuAthlete 数据集,用物理引导的抛物线轨迹修正消除高度漂浮、地面穿透与高频抖动,并以物理驱动的伪低动能(LKE)采样让策略从动力学可行状态初始化。

  2. arXiv cs.RO 机器人学55

    BAT:通过在线策略切换实现人形机器人长时程全身控制的敏捷与稳定平衡

    BAT 提出在线策略切换框架,依据运动上下文在耦合与解耦的全身 RL 控制器间动态选择,采用 OpVQ-VAE 与 OpHRL 两个切换预测器并由 Token-Familiarity Router(TFR)仲裁。在已见长时程运动组合上成功率 85.2%,未见运动上保持 71.3%,并在 Unitree G1 人形机器人上完成零样本部署。

  3. arXiv cs.RO 机器人学38

    悬挂式双足机器人的三阶段离线 SDRE 人体运动复现控制框架

    一套三阶段离线指令生成框架在悬挂式双足机器人上复现了 Vicon 系统记录的人体行走与下蹲动作,关节角度重复试验的平均 RMSE 低于 7°、标准差低于 0.33°。框架先用 SDRE 控制推导参考力矩轨迹,再经参数化优化转为受电机转速与加速度限制的梯形关节速度指令,最后由 PID-LQR 补偿修正。各报告情形下关节角度与力矩轨迹的最大 RMSE 和标准差均低于 MPC 与 IPSO-PID。

  4. arXiv cs.RO 机器人学55

    R2RI:首个面向机器人间交互的多视角 Event 与 RGB 数据集

    R2RI 是首个专为机器人间交互(RRI)任务设计的数据集,包含多款人形机器人基于真实人类社交行为建模的交互场景,提供各机器人机载传感器的第一人称视角与外部固定相机的第三视角。数据集涵盖 Event 与 RGB 两种模态,规模超过 6.5M 帧、约 5000 段视频,帧率达 120 fps,已公开发布全部任务与模态的数据及标注,并对比了两种模态在多项感知与交互任务上的表现。

  5. arXiv cs.RO 机器人学58

    QF3:用过滤 Q 梯度加速流策略强化学习的人形运动控制算法

    论文提出 QF3(Fast Flow RL with Filtered Q-Gradients),一种在线离策略 RL 算法,通过 flow matching 加上 critic 的动作梯度、经一步预测反向传播来训练流策略,且只将 critic 梯度施加于接近回放动作的那些动作维度。

    推荐理由:论文给出相对 FPO++ 的 10x 训练加速和零样本上机结果,可评估该算法是否值得在人形运动控制任务中试用。

  6. arXiv cs.RO 机器人学51

    From Legs to Wheels: 面向轮式移动底盘人形机器人的具身感知人体动作重定向

    针对轮式移动底盘人形机器人(含移动底盘、升降柱与双臂)难以直接套用腿部人形重定向方法的问题,研究提出一种任务条件化框架,将重建的人体动作分配给底盘、升降与手臂职责后再做机器人侧实现。部署适配器以 50 Hz 输出指令,采用静止底盘检测、死区与斜率滤波、时间一致回放缩放以及线性与角速度独立增益。评测涵盖人体导出的任务空间对比、无策略仿真回放与真机定性执行。

  7. arXiv cs.RO 机器人学55

    iGPC:面向物体感知的类人机器人全身交互生成式运动先验

    iGPC 将 Generative Pretrained Controller(GPC)从通用人体运动扩展到类人机器人与环境的全身交互,通过场景可供性线索与特权状态信息训练交互专家,再由机载传感器观测的学生策略蒸馏接触、抓握与推动技能。实验在多个全身交互任务上验证,大规模生成式人体运动先验可作为类人机器人在接触密集真实环境中学习可部署策略的有效基础。

  8. arXiv cs.RO 机器人学52

    GENESIS-Handover:基于生成式假设选择的反应式任务导向机器人-人类递物方法

    GENESIS-Handover 利用 VLM 图像生成产生多种任务特定的手-物交互假设,并实时与观测到的人类手部姿态匹配,以推断最合适的递物配置。在 12 名参与者、5 组任务-物体配对的用户研究中,83.3% 的参与者认为该方法比先前的 state of the art 具有更好的任务理解能力。

  9. arXiv cs.RO 机器人学55

    Beyond Retargeting:基于原子运动基元学习的低时延、强鲁棒人形机器人全身遥操作

    一项人形机器人全身遥操作研究提出免重定向策略,将原始人体动作在单次前向传播中直接映射为机器人关节指令,消除在线运动学适配带来的时延与物理不可行目标。该方法学习全身运动基元码本,将分布外观测投影到合理运动原型,并从部分输入中恢复全身运动。在 Unitree G1 上结合虚拟现实、光学动作捕捉、文本生成动作与单目视频输入的仿真与硬件实验中,其时延与鲁棒性表现优于基线方法。

  10. arXiv cs.RO 机器人学54

    高程图看不见什么:人形机器人的语义感知运动与执行感知导航

    一项面向人形机器人的基准与闭环框架提出语义感知运动与执行感知导航,建模高程图中不明显的危险物与指令执行偏差,并在仿真中评估导航、在 Unitree G1 实体机器人上验证运动策略。结果显示语义输入减少了机器人与高程图难以表征的危险物的接触,抗偏差机制提升了导航成功率。研究指出人形机器人导航需同时评估路线完成度与危险规避。

  11. arXiv cs.RO 机器人学57

    InterEvolve 提出奖励程序测试时进化方法用于人形机器人 loco-manipulation

    Zhuo Lin 等人提出 InterEvolve,在不重新训练的前提下让控制器通过测试时进化完成未训练过的人形 loco-manipulation 任务。方法包含 object-aware forward-backward 行为基础模型,以及由 LLM 智能体结合执行反馈与技能库修订结构、数值优化器调节常数的奖励程序。

  12. arXiv cs.RO 机器人学38

    PACE:通过对话式引导在人机交互中实现人格自适应

    PACE 提出交互式人格引导流水线,让 Ameca 人形机器人通过用户问答动态合成定制化、有心理学依据的人格,并编译为多视角维度的结构化人格提示,驱动多模态表达行为。实证 HRI 评估对比通用基线,考察动态生成人格对用户信任、拟人化感知、人格一致性、个人相关性与交互质量的影响。

  13. arXiv cs.RO 机器人学47

    TRABot:为对话式人形机器人整合社交手势与数字人脸并同步语音

    TRABot 是一个基于多智能体的框架,通过运动原子构建、对话生成、运动规划与面部动画四类专用智能体,将语音、面部动画与身体手势整合为连贯响应。系统在物理 G1 人形机器人上部署流式人脸-语音-身体集成系统,结合流式对话音频、音频驱动面部动画与语义规划的身体运动,实现统一实时交互闭环。定量与定性实验显示 TRABot 在自然度、表现力与多模态一致性上取得最佳整体性能。

  14. arXiv cs.RO 机器人学45

    ARISE:面向 Sophia 人形机器人的社会推理与具身交互智能体框架

    ARISE 框架在 Sophia 人形机器人上打通社会推理与具身表达,整合多模态上下文理解、长期记忆及反应式与主动式交互,将社会意图转化为与语音和机械面部表情协同的机器人原生手势。流式执行在 Sophia 上的评测显示交互质量与具身行为协调性良好,并显著降低时延。

  15. arXiv cs.RO 机器人学55

    CoDance:从视频学习人形机器人反应式柔顺双人舞蹈交互

    CoDance 提出一个从视频学习反应式、柔顺人机人形交互的框架,以双人舞蹈为场景,让机器人与移动伙伴协调步伐并保持双手持续接触。给定一段双人舞视频,CoDance 将动作重定向为机器人参考与移动伙伴,并引入多连杆柔顺增强方法,在双手施加结构化力把运动学演示转化为力感知训练数据。

  16. arXiv cs.RO 机器人学43

    利用分层控制器结构进行人形机器人移动操作的上下文参数学习

    提出一种上下文贝叶斯优化框架,用于分层控制系统中质心预测控制器与全身控制器的联合参数学习,保留任务性能、实现质量与控制努力的独立观测,并用相关多输出高斯过程建模。在不同箱体质量下的人形机器人推箱移动操作任务中,该方法在训练与适应阶段均取得所比较基线中最低的平均经验遗憾。

  17. arXiv cs.RO 机器人学54

    面向偏置冗余机械臂的实时 Conformal-Seeded 混合逆运动学求解

    该研究提出一种两阶段混合逆运动学框架,用于求解人形机器人 7-DoF 偏置冗余机械臂的逆运动学:先用近似解析模型枚举候选关节解,再用轻量学习预测器结合 split-conformal prediction 给出校准难度上界排序种子,最后用 Levenberg-Marquardt 在完整运动学模型上精化。

  18. arXiv cs.RO 机器人学57

    人形机器人拉车全身运动控制框架:Unitree G1 实机拖运 115 kg 负载

    论文提出一套人形机器人拉黄包车的全身控制框架,通过特权教师利用车辆状态、交互力和负载属性训练,再蒸馏为仅依赖本体感受历史的学生策略并做强化学习微调。实机上单一策略完成启动、持续拉动、转向与停止,覆盖刚性负载和真人乘客,无需针对负载重新调参即可拖动最高 115 kg 的负载车,且多数负载-速度条件下机器人归一化运输成本低于空载行走。

  19. arXiv cs.RO 机器人学58

    人形机器人全身运动持续学习:Similarity-guided LoRA-PNN 防止灾难性遗忘

    提出 Similarity-guided LoRA-PNN,用渐进式神经网络策略结合轻量 LoRA,在顺序任务流中让人形全身控制器持续学习而不遗忘已掌握技能。基于动态时间规整与最优传输的两级运动相似度决定复用哪个先验技能并分配新容量,在六个顺序学习技能类别上取得最佳前向迁移 0.125 与最高平均准确率,节省最多 94.5% 可训练参数和 40.8% 训练时间。

9月17日周四
  1. Figure AI 新闻78

    Figure 发布 Helix 2.5,实现 30 个陌生家庭零样本全身作业泛化

    Figure 发布 Helix 2.5,机器人在 30 个未采集过数据的湾区家庭中零样本完成整理客厅、叠毛巾、铺床三项全身长时程任务。对照实验显示,在架构、超参与下游数据固定的前提下,仅 Index 预训练就将零样本成功率从 9% 提升到 56%;相比 Helix 02,Helix 2.5 用一半的任务数据达到同等成功率。

    推荐理由:原文给出 Index 预训练与从零训练的对照实验,9% 到 56% 的差距可帮助判断人类数据预训练对零样本泛化的实际贡献。