跳到正文
  1. CNX Software57

    ZeroWire Robotics 推出开源四足机器人 Q8botOne,众筹价 199 美元起

    ZeroWire Robotics 推出掌心大小的开源四足机器人 Q8botOne,基于 ESP32-C3-MINI-1-N4 模块与 8 个 ROBOTIS DYNAMIXEL XL330-M077-T 智能执行器,采用无缆架构,把所有核心元件集成到兼作底盘的中央 PCB 上,尺寸 120 x 70 x 70 mm、重约 221 至 250 克,可慢跑、跳跃并承载约两倍自重。

    推荐理由:原文列出了主控、执行器、电源架构和两档售价,便于与同类小型四足机器人做选型对比。

  2. 雷锋网62

    至简动力冯宗宝:IROS 2026 演讲机器人自主值守双 CNC 机床

    至简动力强化学习负责人冯宗宝在 IROS 2026 现场 Tech Talk 分享了机器人自主照看两台 CNC 机床的方案,在工件与卡盘间隙仅 0.5 毫米的场景下完成抓取、上料、取件与放置,且仅用 600 条真实机器人轨迹完成训练。

    推荐理由:演讲给出了0.5毫米间隙下的具体方法组合与600条轨迹的训练规模,可参考其从实验室到工厂的落地路径。

  3. 雷锋网58

    北醒李远:给机器造眼睛,与「自讨苦吃」的十一年

    雷峰网左林右狸频道对话北醒(Benewake)CEO 李远,回顾其十一年创业历程与对物理 AI 的判断。今年上半年北醒交付机器人用激光雷达 25 万台,机器人业务收入占公司营收超过一半,2025 年该项收入比 2024 年翻了一倍,海外占比超过 50%。

    推荐理由:访谈披露了北醒机器人激光雷达的出货与收入占比,可据此判断机器人赛道的实际放量节奏。

  4. 雷锋网58

    Naive AI 成立 7 个月三轮融资 4 亿美元,背后是代季峰 8 人团队

    清华背景公司 Naive AI(工商注册名北京智衍慧生科技有限公司)成立 7 个月完成三轮融资共 4 亿美元,投后估值 14.2 亿美元,投资方包括腾讯、博裕、红杉中国、IDG、经纬、君联资本等。

    推荐理由:梳理了团队从 MSRA、商汤到上海 AI Lab 的十年合作脉络,可理解资本押注这支队伍的依据。

  5. 雷锋网58

    CAIR发布多模态临床智能体CARES 4.0,刘宏斌谈其从工具升级为智能体

    CAIR在香港具身智能医疗科技论坛上发布多模态临床智能体系统CARES 4.0,基于Harness智能体框架和自研CT、核磁、超声、内镜、脑电多模态医疗基座构建,已在多家三甲医院完成落地验证,官网已开放、框架与通用工具包已发布。

    推荐理由:访谈对比了3.0与4.0的差别并给出幻觉治理思路,可迁移给做垂直领域智能体的团队。

  6. 雷锋网58

    吴佳俊 IROS 2026 演讲:结构化表征是机器人学会推理的脚手架

    斯坦福大学助理教授吴佳俊在 IROS 2026 RoBoWoMo 研讨会发表受邀报告《Building Physical Agents via Structured Representations》,以洗盘子场景说明机器人需应对初始状态的定性差别与新观测。

    推荐理由:演讲把结构化表征定位为可迁移的中间接口而非硬约束,对做机器人学习框架的人有方法论参考。

  7. 雷锋网64

    银河通用与清华 LATENT:用不完美人类数据让 Unitree G1 学会网球对打

    IROS 2026 上,银河通用 GaLbot 团队与清华大学、北京大学、上海启智研究院和上海人工智能实验室提出 LATENT,让 Unitree G1 从 5 名业余球员在 3米×5米区域采集的约 5 小时不完美动作数据中学习网球能力。

    推荐理由:文中给出成功率、消融和真机限定条件,读者可据此判断该方法的真实能力边界。

  8. 雷锋网60

    研究了1933篇 IROS 2026 论文,我们看到了机器人学的六项新变化

    文章对 IROS 2026 进入正式议程的 1933 篇论文做多标签梳理,Robot Learning / Embodied AI 约 809 篇、Navigation / Planning 564 篇、Humanoid / Legged 约 213 篦,指出大模型并没有吃掉机器人学,学习、感知、规划、控制与操作正深度交织。

    推荐理由:对1933篇论文的多标签统计给出了各方向的篇数与交叉数据,可据此判断机器人研究的真实重心分布。

  9. arXiv cs.RO 机器人学64

    Visible Touch:为视觉运动策略渲染接触信息

    Visible Touch 论文提出把接触信号暴露在策略已关注的同一空间坐标系中,使任何图像条件策略无需架构改动即可直接利用触觉信息,并配套开源一款用现成零件经参数化 CAD-to-mold 流水线制造的低成本磁性接触传感器。

    推荐理由:论文给出把接触信号嵌入策略已有视觉坐标系的做法与开源低成本传感器,读者可据此评估无需改动架构的触觉接入路径。

  10. arXiv cs.RO 机器人学66

    RoboJEPA:面向多本体机器人世界模型的扩展律研究

    论文提出基于 JEPA 的机器人世界模型 RoboJEPA,在覆盖 12 种机器人本体的大规模真实机器人数据集上训练,其想象误差(latent rollout 误差)随算力呈二阶幂律,可在拟合规模之外预测模型质量。

    推荐理由:论文给出想象误差随算力的二阶幂律,为评估多本体世界模型规模提供了可迁移的预测方法。

  11. Hugging Face 每日论文56

    RLHND:用视频基础模型从第一人称视频同时估计手部位姿与触觉

    RLHND 提出一种基于视频基础模型的手部跟踪模型,从单目第一人称视频中联合估计手部位姿与真实触觉信息。它把预训练的 Cosmos 3 视频扩散主干通过 clean-latent 条件化改造成确定性的片段级特征提取器,位姿流预测解剖学上合理的关节角度并支持形状参数条件化,触觉流在位姿流冻结下预测手表面的密集接触与力。

    推荐理由:论文说明了用视频基础模型补上接触与力线索的思路,关注人视频用于机器人策略训练的读者可了解其方法路径。

  12. Hugging Face 每日论文64

    Long-WAM:扩展世界-动作模型上下文的模型系统框架

    Long-WAM 提出在实时控制约束下扩展因果世界-动作模型上下文的模型系统框架,核心发现是访问历史不等于使用历史,更长历史只有在视频底座经自回归预训练时才显著见效。

    推荐理由:论文用对照实验说明自回归预训练的视频底座才让长历史真正转化为成功率提升,可为世界模型选型提供依据。

  13. 机器人大讲堂58

    别把自动驾驶的进度表套到具身智能上

    文章认为自动驾驶能迁移给具身智能的是约50%的技术基建和方法论,但那张时间表不该一起搬。光象科技CEO张涛指出迁移部分落在数据采集、清洗、端到端训练、仿真验证和真机测试流程上,而接触类任务是机器人独有的难点;自变量王潜认为自动驾驶难点在导航和运动,机器人难点在操作,视觉只差几像素的两瓶水在动作层面就是两件事。

    推荐理由:原文用50%迁移比例、仿真真机成功率落差和出货量对比,拆解了自动驾驶方法论能给具身智能留下什么、带不走什么。

  14. 机器人大讲堂66

    Skild AI 发布开源人形平台 BRIDGE 论文,88厘米13公斤参考身体

    9月15日arXiv出现论文《BRIDGE:An Open-Source Humanoid Platform via Morphology-Control Co-Design for Physical AI》,Skild AI两位创始人参与创作,展示了一台高88厘米、13公斤的开源人形平台,硬件图纸、控制策略、训练脚本全部公开。

    推荐理由:文章梳理了Skild AI从卖大脑到开源参考身体的路径,并与宇树、智源的同类做法对比,便于理解接口之争。

  15. IEEE Spectrum · Robotics57

    HiPHI:面向人形机器人大规模高精度人体动作与物体交互数据集白皮书

    IEEE Spectrum 与 Wiley 联合发布由 Noitom Robotics 赞助的白皮书,介绍 HiPHI 数据集:617.5 小时光学动作捕捉的全身人体动作数据,亚毫米级精度,其中 245.7 小时为人与物体交互数据,含同步物体轨迹与网格,并用 FrameNet 语言框架组织动作覆盖范围。

    推荐理由:白皮书给出了数据集规模与人机交互数据的组织方式,关注人形机器人数据来源的读者可据此评估其补充价值。

  1. arXiv cs.RO 机器人学58

    PointZero:以 3D 点轨迹补全作为预训练目标学习可迁移的 3D 动力学

    PointZero 提出以 3D 点轨迹补全作为预训练目标,仅凭单帧 RGB-D 观测和稀疏部分 3D 轨迹预测所有观测点的未来 3D 轨迹,无需机器人动作标签即可学到 3D 动力学先验。

    推荐理由:论文提出无需机器人动作标签的预训练目标,可帮助理解如何利用网络视频数据学习 3D 动力学先验。

  2. arXiv cs.RO 机器人学62

    FineART:细粒度标注双臂操作数据集与 FineART-VLA 模型

    研究团队提出 FineART 双臂操作数据集,包含 40,543 个 episode(1,718 小时)、533,913 个子任务、覆盖 151 项任务,并开源数据集、模型权重与训练代码。

    推荐理由:论文给出子任务标注带来的成功率提升幅度,可评估密集标注对双臂长程任务的价值。

  3. arXiv cs.RO 机器人学58

    研究解析行为提示在机器人操作任务中的生效条件

    该论文对行为提示(behavior prompting)何时、如何生效进行了实证研究,引入 DrawAnything 和 LIBERO-Gen 基准(最多 2000 个程序生成任务)、上下文视觉运动架构 Behavior Prompting Policy(BPP)以及手持演示接口 iPhUMI。

    推荐理由:论文用消融实验指出任务多样性比单任务演示数更关键,做数据采集取舍的团队可参考这一结论。

  4. arXiv cs.RO 机器人学58

    FingerEye:基于连续视觉触觉感知的灵巧操作学习框架

    FingerEye 是一个传感与学习框架,通过贯穿交互全程的视觉触觉反馈提升机器人灵巧操作能力。传感侧将双目 RGB 相机与柔性接触界面结合,接触前用指尖相机提供近距视觉线索与隐式立体信息,接触后用标记点追踪柔性环形件形变作为接触力旋量感知的代理;学习侧构建了真机与仿真数据基础设施,并提出 FingerEye Policy,采用分组结构的模态融合以减少模态捷径。

    推荐理由:论文给出视觉触觉融合的具体设计与七项任务上的量化提升,可作为多模态灵巧操作方案的参考。