跳到正文
今天10月8日周四225 条
  1. arXiv cs.RO 机器人学47

    Co²Skill:通过技能组合实现长时程人机环境交互的全身控制

    Co²Skill 提出统一策略,将场景交互与灵巧物体操作整合到同一全身控制框架中,基于预训练运动先验并使用任务与阶段相关的观测掩码选择信息。该方法引入目标条件下的 loco-manipulation 课程与跨任务课程,联合训练单项技能和选定任务序列,在任务边界保持物理状态并维持抓取。在坐、站、爬、上下楼梯及目标导向操作等任务上完成评估,并在室内环境中演示了技能组合。

  2. arXiv cs.RO 机器人学49

    LACE-CRAFT:结合 Actor 继承与 Blackboard 协作的机器人协同设计方法

    LACE-CRAFT 提出一种机器人协同设计方法,通过 Actor 参数继承与 Blackboard 协作,在形态搜索中复用已有控制经验。在五个运动基准上,其三个评估种子的平均得分较 D2C 高 6.4-91.9%。两种方法均在五轮中训练 30 个新形态-奖励对,LACE 另使用四个续训单元,并通过实物原型演示了室内行走与几何到硬件的工作流。

  3. arXiv cs.RO 机器人学36

    评估协同进化通信机制从 2D 到 3D 仿真的迁移

    一项研究评估了两个机器人智能体间协同进化的通信机制从离散 2D 仿真器迁移到具备真实物理的 3D 仿真器后的功能保持情况。结果显示成功率在 2,000 至 6,000 物理步的时间预算内近似线性增长且无平台期,短时评估会低估控制器性能;social cue 在两种仿真器中主要起拥堵辅助作用而非导航引导,8 次独立进化运行显示角色不对称方向一致但幅度各异。

  4. arXiv cs.RO 机器人学56

    IROS 2026 论文提出多物体多目标抛掷快速规划框架

    论文提出多物体多目标抛掷(MOMT)的两阶段快速规划框架,离线建模可行集,在线生成可行抛掷动作的序列组合耗时低于 5 ms。在 7-DoF 机械臂配多指手的平台上,仿真中双物体协同抛掷较独立单物体规划缩短执行时间至多 46%,三物体保持该提升;真机双物体实验确认缩短 29%,与理论 50% 的差距来自抛掷间过渡开销。

  5. arXiv cs.RO 机器人学46

    间歇观测下的信念空间规划:预测并惩罚规划器条件化估计器误差

    arXiv 论文提出一种信念空间规划方法,沿评估轨迹预测、传播并惩罚规划器条件化的估计器误差,用仿射误差动力学与矩递推建模间歇随机修正带来的额外不确定性。仿真中对倾转旋翼 VTOL 舰船甲板降落进行滚动时域规划,条件化建模使命令盲 EKF 的误差预测损失相对规划器无关模型降低 13.4%。

  6. arXiv cs.RO 机器人学57

    Beyond Reconstruction:机器人策略动作分词中哪些因素真正重要

    论文提出 ProAct 动作分词器训练方法,在重建目标之外增强下游可预测性与鲁棒性,该方法与策略无关且仅用动作数据训练。在 Robomimic、LIBERO、RoboTwin 基准及多种分词器架构上,ProAct 平均提升 rollout 成功率 11.3 个百分点,迁移到视觉语言动作策略和真实机器人操作时分别平均提升 21.8 和 36.7 个百分点。

  7. arXiv cs.RO 机器人学52

    统一运动学表示实现可复用的生物关节力矩估计

    论文提出以关节运动学作为中间表示,将硬件相关传感与下游生物关节力矩估计解耦,估计器仅用开源生物力学数据训练。在髋部外骨骼、膝部外骨骼和IMU传感器套件的平地与坡道行走数据上评估,RMSE分别为0.17 Nm/kg(R2=0.79)、0.19 Nm/kg(R2=0.62)和0.15 Nm/kg(R2=0.85),表明仅用开源数据训练的估计器可跨不同可穿戴平台运行。

  8. arXiv cs.RO 机器人学55

    HULK:面向人形机器人全身用力 loco-manipulation 的控制框架

    论文提出 HULK 全身控制框架,用 MPC 预测负载动力学引导强化学习,训练两个教师策略(腕力下跟踪手臂动作、抱持大物体行走),再蒸馏为单一策略,并在仿真与 Unitree G1 上评测。仿真中带屏障函数的教师在每臂 10 kg 负载下前向与横向速度跟踪误差最低,DCM 偏移总量较仅用 MPC 引导强化学习降低 35.7%,腕力教师可承受高达 130 N 的躯干推扰。

  9. arXiv cs.RO 机器人学42

    面向地外独立异常分诊的证据驱动人-智能体-机器人协作架构

    一篇被 2026 IEEE/RSJ IROS 空间机器人研讨会接收的论文提出了一种证据驱动的人-智能体-机器人协作架构,用于深空任务中脱离地面支持的异常分诊。该架构将 Agentic AI 作为有状态协调器,通过分诊状态管理器维护假设与证据溯源,并由移动机器人获取局部证据,已在基于 Reachy Mini 和 Innate MARS 移动机器人的硬件在环原型上验证。

  10. arXiv cs.RO 机器人学51

    DexUMI 外骨骼手侧几何对触觉表征与灵巧策略性能的影响研究

    论文研究了 DexUMI 系列外骨骼的两个版本,二者共享相同的机器人指令定义、映射流程和触觉模块类型,但手侧几何不同。改款接口降低了操作者体力负担,在基线版本被机械阻挡的精密抓握中实现了触觉采集,并带来任务相关的接触变化:拧盖任务主要表现为接触位置改变,打开蛋托主要表现为接触有无变化。

  11. arXiv cs.RO 机器人学55

    NeurIPS 2026 论文 Ariadne:仅用状态观测的流形引导轨迹规划

    论文提出 Ariadne,通过学习状态空间流形并利用其几何结构进行轨迹规划,训练只需状态观测、无需专家轨迹数据。在 Maze2D 与机器人运动规划基准上,Ariadne 能从仅状态监督构建可行路径并泛化到未见过的起终点组合;在高维双臂规划上,其表现与轨迹监督方法和经典规划器相当。该论文已被 NeurIPS 2026 接收,代码已开源。

  12. arXiv cs.RO 机器人学54

    CIRRA:面向家庭机器人持续指令融合的双层框架与CHIRP基准

    论文提出CIRRA(Continual Instruction Reconciliation for Robot Agents)双层框架,让家庭机器人在执行任务过程中接收新指令时,保留正在进行的子任务序列作为执行骨架,仅对被修改的片段做语义推理,插入位置匹配的新子任务,从而减少计划歧义、逻辑不一致和冗余执行。

  13. arXiv cs.RO 机器人学47

    基于因子图与场景图的动态环境机器人世界模型综述

    一篇 arXiv 综述系统梳理了机器人领域基于因子图与场景图的世界模型如何应对动态环境,围绕表示、构建与更新流程、下游任务利用三方面展开,并重点分析融合两类图的混合模型。综述归纳了常见架构模式,并指出从学习感知到表示层的不确定性传播、动态实体运动可观测性、可扩展的终身维护,以及缺乏数据集与评测协议等开放挑战。全文 34 页,含 7 张表、8 幅图。

  14. Hugging Face 每日论文55

    长上下文混合模型机理研究 Part 1.1:从混合注意力到混合位置

    论文提出长上下文混合模型机理系列研究 Part 1.1,聚焦全注意力与 SWA 或 GLA、GDN 等线性注意力变体的混合结构。作者观察到上下文扩展中的跷跷板效应,即线性注意力混合模型更受益于长上下文持续预训练,而 SWA 混合模型在长度外推上表现更好,并将其归因于位置归纳偏置差异;同时指出 SWA 混合模型存在短上下文学习陷阱、短窗口倦怠和长窗口惰性。

  15. Hugging Face 每日论文49

    SGF+:解耦自回归视频生成中的梯度流

    SGF+(Self Gradient Forcing Plus)为自回归视频生成中的上下文写入与去噪分配独立参数,通过因果注意力保留两者交互,并用原始生成目标联合优化。在仅用 5s rollout 训练的条件下,SGF+ 无需长视频微调即可连续生成长达 24 小时的视频,视觉质量与长时一致性优于所评测的基线,且无需额外视频训练数据或更长训练周期。

  16. Hugging Face 每日论文57

    多向量视觉文档索引可被反演还原页面内容

    论文提出从多向量视觉文档检索器存储的索引中反演还原原始页面,把反演建模为条件文档图像生成。在 ViDoRe v3 基准上,从原始索引反演的页面可恢复 47% 的词和 45% 的敏感 token,用作查询时 98.4% 能把源页面排在首位。

    推荐理由:论文用实验量化了多向量文档索引的反演风险,并测试了两种低成本防护的实际效果,做文档检索系统安全评估时可参考其方法。

  17. Hugging Face 每日论文64

    Long-WAM:扩展世界-动作模型上下文的模型系统框架

    Long-WAM 提出在实时控制约束下扩展因果世界-动作模型上下文的模型系统框架,核心发现是访问历史不等于使用历史,更长历史只有在视频底座经自回归预训练时才显著见效。

    推荐理由:论文用对照实验说明自回归预训练的视频底座才让长历史真正转化为成功率提升,可为世界模型选型提供依据。

  18. Hackaday47

    用 ESP32-S3 小型 AM 发射器让老式收音机继续发声

    一位创客用 ESP32-S3 制作了一台小型 AM 发射器,接收网络电台流后通过 GPIO 脉冲链生成射频信号,让老式电子管收音机重新发声。发射器采用 3D 打印外壳与支架固定的大间距线圈天线,输出频率为 200kHz 的欧洲长波波段,足以被老式收音机接收。作者指出该发射功率下可能不合规,但认为功率极低不会被察觉。

  19. LWN.net32

    LWN.net 周刊 2026 年 10 月 8 日版

    LWN.net 发布 10 月 8 日周刊,头条内容涵盖内核 bug、Gentoo 的 Chromium 软件包、Rust 智能指针、Sashiko、Charon 与 LAVD 调度器、Python 随机数模块。简讯部分收录 OpenSSH 10.6、RustConf 演讲录像、Rust 1.99.0、Picard 3.0、Zig 0.17 等条目,另有新闻邮件、会议、安全更新与补丁等公告。

  20. CNX Software62

    Efinix 发布 Sapphire RV64 可配置 RISC-V 软核 SoC

    Efinix 推出 Sapphire RV64 SoC,这是一款面向 Titanium、Topaz 和 Trion(T20 及以上)FPGA 的可配置 64 位 RISC-V 软核,基于 VexiiRiscv,可配置 1 至 4 个核心,主频最高 400 MHz。

    推荐理由:原文列出了主频、缓存、内存支持和外设配置,做 FPGA RISC-V 选型的工程师可据此评估是否替换现有 32 位方案。

  21. TechCrunch · Robotics56

    机器人数据初创公司 Mecka AI 获红杉领投 6000 万美元 B 轮融资

    Mecka AI 宣布完成 6000 万美元 B 轮融资,由红杉领投,Nvidia、微软风投基金 M12 等参投;TechCrunch 此前报道该轮融资估值接近 5 亿美元。这家公司成立于 2024 年,付钱让人们穿戴身体传感器、用手机记录做咖啡、修车等日常任务,为机器人训练采集人体动作数据,对标 Scale AI、Mercor、Surge 等为 LLM 供数的数据标注公司。

  22. Hackaday47

    串流游戏让 Nintendo DSi 永不过时

    玩家 gavff64 通过自制软件 RNDS-Stream 让 2008 年的 Nintendo DSi 串流游玩 PC 上的游戏,以约 15-20FPS 解码来自 Linux 主机的 MJPEG 流,画面延迟较低但暂不支持音频。该项目是 RubyNDS(基于 Ruby 的 DSi 自制框架)的展示作品,已以 MIT 许可证开源在 GitHub 上。