CAIR发布多模态临床智能体CARES 4.0,刘宏斌谈其从工具升级为智能体
CAIR在香港具身智能医疗科技论坛上发布多模态临床智能体系统CARES 4.0,基于Harness智能体框架和自研CT、核磁、超声、内镜、脑电多模态医疗基座构建,已在多家三甲医院完成落地验证,官网已开放、框架与通用工具包已发布。
推荐理由:访谈对比了3.0与4.0的差别并给出幻觉治理思路,可迁移给做垂直领域智能体的团队。
CAIR在香港具身智能医疗科技论坛上发布多模态临床智能体系统CARES 4.0,基于Harness智能体框架和自研CT、核磁、超声、内镜、脑电多模态医疗基座构建,已在多家三甲医院完成落地验证,官网已开放、框架与通用工具包已发布。
推荐理由:访谈对比了3.0与4.0的差别并给出幻觉治理思路,可迁移给做垂直领域智能体的团队。
TwelveLabs 发布 Pegasus 1.6 模型,面向机器人、无人机和自动驾驶等物理 AI 场景,是其首个面向第一人称视频的 AI 模型,不依赖特定相机或专有硬件。
推荐理由:原文列出了五项工作流和第一人称视频定位,做机器人数据管线的团队可据此判断是否接入。
FireDome 推出自主地面发射系统,通过发射含水或阻燃剂的弹丸(最远 1,000 ft.)在野火到达前铺设阻燃隔离带、覆盖建筑并扑灭飞火引发的点火点。系统采用机械发射柔性智能弹丸,每枚约装 10 gal. 液体,在近地面高度展开形成椭圆覆盖区,三层防御分别对应外围隔离带、建筑覆盖和点火点扑灭,默认自主运行并可远程关停,计划与加州消防指挥体系集成。
推荐理由:文章拆解了发射器与三层防御逻辑,可了解自主灭火系统如何嵌入现有消防指挥体系。
Overview AI 推出 OV Spark 与 OV Spark Pro 两款 AI 检测相机,内置 agentic AI 层 Sparky,可用自然语言回答检测相关问题。
推荐理由:原文给出了硬件规格、工具清单和 MEC 落地案例,便于评估该相机在产线的实际可用性。
东京初创公司MW把沿天花板轨道滑动的双臂机械臂MW bot集成进住宅,首批不含机器人版本定价2亿~4亿日元,已在东京、横滨、福冈推进项目,搭载机器人的版本计划2028年上市。
推荐理由:文章拆解了MW把机械臂集成进住宅的路线选择,以及它与双足人形方案在安全、算力和心理感受上的取舍。
Boston Dynamics 发布 Atlas 机器人的新一代灵巧手,自由度从上一代的 7 增至 13,采用四指设计并支持手指张开,可握持带扳机的工具手柄。新手手将执行器直接嵌入关节、采用直驱配置,执行器包可整体更换,去掉了跨关节易损的腱绳与线缆,以兼顾可靠性、可仿真和低成本量产。Boston Dynamics 表示目前正研究细节调整,目标是实现年产 100,000 只的规模。
推荐理由:原文给出自由度从 7 增至 13、直驱关节与可更换执行器包等设计取舍,可对照理解灵巧手在可靠性与量产成本上的权衡。
波士顿动力为新一代 Atlas 发布四指灵巧手,共 13 个自由度、直接驱动,尺寸接近大型人手且平均力量更强,可搬运装满 100lb+ 的小冰箱。手部配备覆盖指尖和掌面的密集压力触觉传感器,关节可反向驱动以实现本体感知,支持捏取、三指抓握和握持电钻、射钉枪、焊枪等带扳机工具。
推荐理由:原文解释了四指 13 自由度设计如何在灵巧性、强度与量产成本之间取舍,可为同类末端执行器选型提供参考。
智元与炊具品牌爱仕达合作落地,100台灵犀X2人形机器人进入爱仕达全国100家门店担任促销员,覆盖六十多个城市。双方在温岭、上海、无锡三地开展为期三天、每天10小时的直播,百店累计销售金额达225.3万元,带动门店业绩增长39%。
推荐理由:原文给出三天直播的销售金额与增长比例,并拆解了机器人与真人导购的分工边界,可作为零售部署的验收参照。
逐际动力与英汉思动力联合研发的具身网球机器人 TENNIIX ULTRA MAX 亮相比利·简·金杯深圳总决赛,与网球选手王蔷完成现场实时人机对打。
推荐理由:原文给出了双轮足底盘的负载、出球高度和算法分工,可看出通用本体加场景算法的落地路径。
Figure AI 发布机器人训练数据集 Index,配套 App 已在 Google Play 与 App Store 上线,累计下载 264,000 次、覆盖 108 个国家,Creator 上传超 1600 万条视频,每秒处理 30 分钟视频上传。
推荐理由:原文披露了每千小时数据的任务与物体多样性指标,以及五阶段数据管线,可作为机器人数据采集规模化的参考。
Skild AI 发布旗舰机器人基础模型 S1,作为上下文学习器,仅凭一段视频演示即可执行未在预训练中出现、最长 10 分钟的操作任务,无需微调或后训练。在内部基准上,未见任务中 ICL 在 100k 小时预训练数据下达到 66% 成功率,语言提示 VLA 为 9%;已见任务中 S1 达到约 96%。一次上下文演示约等于 380 个后训练示例,植物移盆任务从演示到自主执行用时 11 分钟。
推荐理由:原文给出 ICL 与语言提示 VLA 在 1k 到 100k 小时预训练下的成功率对比,可作为评估提示范式选型的参考。
7 月 5 日,Boston Dynamics 的量产版人形机器人 Atlas 在 2026 世界杯挪威对巴西的淘汰赛中场休息时登场,向裁判递交比赛用球并表演进球庆祝动作,这是 Atlas 量产版首次公开亮相。
推荐理由:访谈披露了从 Spot、Stretch 到 Atlas 的部署经验,说明机器人只是系统一部分,客户真正购买的是巡检等能力。
逐际动力随 COSA 0.5 发布 V³-0,即机器人 OS COSA 中 VLA-tools 层的首个版本,支持移动全身操作的人形 VLA 技术栈。V³-0 运行在 43 自由度的人形机器人 Oli 上,多级架构让感知、决策与执行在不同时间尺度协同运行,LimX-WBT 跟踪全身目标并维持动态平衡,统一移动与操作。
推荐理由:原文给出 V³-0 的多级架构与人类在环真机强化学习闭环,可作为人形 VLA 技术栈设计的参考。
波士顿动力演示四足机器人 Spot 从配送车卸货后自主上门送件,可载两个 16x12x10 英寸包裹,覆盖厢式货车平均约 60% 的件量。顶部传送带载荷配停止传感器与前伸托盘实现软性投放,甚至配送过一盒鸡蛋。初期由司机遥控,路线保存后可对已知地址自主配送,目标是每经 Spot 送 3 件即为货车多装 1 件。
Boston Dynamics 的 Spot 机器人被部署到 FIFA 世界杯 2026 的达拉斯国际广播中心和 NY/NJ 体育场,执行周界巡逻以支持资产保护和风险检测。
推荐理由:原文给出 Spot 在赛事安保中的具体部署地点和处置流程,可看出其安防任务的实际落地方式。
Figure 最新一代人形机器人 Figure 03 已抵达 BMW Group Plant Spartanburg 的 Hall 52,首次在该工厂演示物流排序(sequencing)工作流。
推荐理由:原文给出 Figure 02 去年参与装配 30,000 辆车的基线,可对照理解 Figure 03 从取放到排序任务的升级。
Sanctuary AI 宣布其 Physical AI 在一家全球 Tier 1 汽车供应商的复杂线缆插装任务上达到 99.5%+ 的任务成功率,节拍时间 2.54 秒,并通过客户实际产线基准验证。
推荐理由:原文给出了线缆插装任务的 99.5%+ 成功率与 2.54 秒节拍,可作为柔性物料自动化落地的参考基准。
波士顿动力与现代合作,用人类示范和强化学习训练 Atlas 人形机器人完成此前未见的 Ghost Rabona 花式踢球动作。团队用光学动作捕捉记录球员与工程师 Roberto 的高保真运动数据,经重定向映射到 Atlas 运动学结构后,在云端 GPU 并行数千次仿真训练,相当于 24 小时内完成一年的物理试错,学到的策略几乎全部首次上机即成功。该训练方法可迁移到仓储、工厂等实际作业任务。
逐际动力正式发布全尺寸交互人形机器人 LimX Luna,面向商业服务场景,身高 160cm,具备 27 个机身自由度(不含末端执行器),搭载自研 System 0 全身运控基础模型,支持语音、视觉等多模态交互与姿态模仿。
推荐理由:原文给出了身高、自由度、续航和群控规模等参数,可据此了解商业交互人形机器人的配置水平。
Figure 演示两台 Helix-02 人形机器人在两分钟内协作完成卧室整理,包括开门、挂衣服、收耳机、合书、倒垃圾、推椅子和共同铺床。两台机器人共用一个学习得到的 Vision-Language-Action 策略,没有共享规划器、消息传递或中央协调器,各自通过相机读取场景并仅凭动作推断对方意图。
推荐理由:原文给出了双机器人协作的实现方式,即无共享规划器、仅靠各自相机推断对方意图,可作为多智能体操作的参考。