别把自动驾驶的进度表套到具身智能上
文章认为自动驾驶能迁移给具身智能的是约50%的技术基建和方法论,但那张时间表不该一起搬。光象科技CEO张涛指出迁移部分落在数据采集、清洗、端到端训练、仿真验证和真机测试流程上,而接触类任务是机器人独有的难点;自变量王潜认为自动驾驶难点在导航和运动,机器人难点在操作,视觉只差几像素的两瓶水在动作层面就是两件事。
推荐理由:原文用50%迁移比例、仿真真机成功率落差和出货量对比,拆解了自动驾驶方法论能给具身智能留下什么、带不走什么。
文章认为自动驾驶能迁移给具身智能的是约50%的技术基建和方法论,但那张时间表不该一起搬。光象科技CEO张涛指出迁移部分落在数据采集、清洗、端到端训练、仿真验证和真机测试流程上,而接触类任务是机器人独有的难点;自变量王潜认为自动驾驶难点在导航和运动,机器人难点在操作,视觉只差几像素的两瓶水在动作层面就是两件事。
推荐理由:原文用50%迁移比例、仿真真机成功率落差和出货量对比,拆解了自动驾驶方法论能给具身智能留下什么、带不走什么。
9月15日arXiv出现论文《BRIDGE:An Open-Source Humanoid Platform via Morphology-Control Co-Design for Physical AI》,Skild AI两位创始人参与创作,展示了一台高88厘米、13公斤的开源人形平台,硬件图纸、控制策略、训练脚本全部公开。
推荐理由:文章梳理了Skild AI从卖大脑到开源参考身体的路径,并与宇树、智源的同类做法对比,便于理解接口之争。
文章对比爱芯元智AX8850与瑞芯微RK3588在端侧AI推理上的实测表现,引用双方官方benchmark数据,AX8850在YOLOv5s、YOLOv8n等模型上FPS达到RK3588单核的7~12倍。
推荐理由:原文用双方官方benchmark的同模型FPS对比,把标称TOPS与实际推理性能的差距讲清楚,可迁移为选型时看实测数据的方法。
机器人大讲堂分析认为,机器人产业最先跑通的落地场景可能在体育场、主题乐园和城市广场,而非工厂或家庭。据其不完全统计,4 月至 9 月底机器人赛事覆盖五个主要城市、五种赛制,参赛机器人总数超过 2200 台,其中第二届世界人形机器人运动会有 2056 台机器人同场竞技,赛项从 19 个扩到 50 个。
推荐理由:原文梳理了五座城市机器人赛事的规模与出货数据,可用来理解文体旅场景为何先于工厂和家庭形成落地。
FCC 于 7 月将外国产先进机器人设备列入构成国家安全或安全风险的清单,新设备无法获得进口、在美销售所需的 FCC 认证,涵盖人形与四足等可采集环境信息的移动机器人。
推荐理由:文章梳理了FCC限制如何从采购传导到机器人架构选择,对评估本地推理与供应链策略有参考价值。
文章认为AI会取代把需求翻译成能跑代码的工作方式,但工程经验反而更值钱。文中汇总多组实验:大模型在126道嵌入式小练习上最强的DeepSeek-R1只做对55.6%,无硬件反馈时Claude Opus 4.7、Gemini 3.1 Pro等模型十轮内一次都没部署成功;16名资深开发者用AI后实测反而慢了19%,新手测验分数低了17%。
推荐理由:原文汇总了多组大模型写嵌入式代码的实测与对照实验,可用于判断AI在硬件相关任务上的真实边界。
2026年上半年,人形、四足机器人进入焊接展示和试点场景,焊接单元旁开始出现数百TOPS算力的边缘计算平台,竞争焦点转向负责焊缝识别、轨迹规划与工艺决策的焊接大脑。
推荐理由:原文梳理了多家焊接大脑企业的技术路线差异,可帮助理解具身智能向焊接等工艺场景迁移的共性与边界。
Figure AI 于 2026 年 9 月 30 日发布短片《F.02 Decommission》,把第二代人形机器人 F.02 运到芬兰伊马特拉,让其自主跳入 75 吨电弧炉钢水销毁,官方称拆解定制执行器会拖慢 F.04 进度。
推荐理由:文章把销毁旧机队的资产账、稀土回收难题和中国回收法规放在一起,可用来理解人形机器人退役处置的不同路径。
曙光8000 国产十万卡 AI 超集群通过"超级隧道"打通网卡、CPU 核心与硬盘之间的直通数据路径,以微控、零中断、零竞争、零拷贝减少计算卡等待数据的开销。配套 GPU 直通存储技术 XDS、BurstBuffer 缓冲层与内存加速层分层承接传输、突发读写与高速访问需求,并延伸至 ParaStor 分布式全闪存储与 FlashNexus 集中式全闪存储产品。
AMD以约82亿美元全股票交易收购World Labs,李飞飞将加入AMD任执行副总裁兼首席科学家,交易预计2026年底前完成。文章借此梳理国内世界模型的三条路线:腾讯混元偏空间生成,群核科技偏空间数据与仿真训练,影身智能从多视角真实4D数据切入,经4D重建、世界模型到真机执行闭环。
推荐理由:原文把AMD收购World Labs与国内三条世界模型路线并置,可用来理解4D世界模型从数据到产线的落地差异。
Meta 个人 Agent 产品 Muse 截至 9 月下旬下载量突破 300 万,一度将 ChatGPT 挤下美国 App Store 免费榜第一;OpenAI 于 9 月 29 日发布可长期在线的个人 Agent 产品 dots,提出 "always-on agents"。
IP5统计口径下,截至2026年上半年中国人形机器人相关专利占比达60.8%,较2024年的51.8%上升,美国降至21.8%;同期中国提交1584件申请,美国113件。LexisNexis分析显示,全球专利实力前十初创企业前五名均来自中国,傅利叶、智元居前两位,但美国在平均专利质量上仍居首。文章认为专利优势要转化为产业优势,还需跨越执行器、减速器与人工装配构成的成本鸿沟。
推荐理由:原文梳理了IP5口径下人形机器人专利的中美数量与质量差距,并给出专利向产业优势转化的成本约束。
华为在AIDC产业发展大会上发布3D数据中心,采用供冷层、IT算力层、供电层、备电层的垂直四层立体堆叠架构,面向大规模智算集群。小枣君解读称,该设计将电力模块至机柜的供电距离从17米缩短至5米,IT供电容量从76MW提升至168MW,机电预制化率超90%,机电交付周期从6个月压缩至3个月。
推荐理由:原文拆解了四层垂直堆叠架构如何压缩供电距离与交付周期,可作为理解智算基础设施演进的参考。
海思断供后,富瀚微成为海康威视安防 SoC 的主要替代供应商,IPC SoC 市占率约 10%,NVR 录像机芯片市占率接近 28%。公司自研 AI-ISP「极光」引擎可将暗光场景信噪比提升 12dB,车载 ISP 前装出货量全球第一,并推出 AI 眼镜芯片 MC6350。2026 年上半年富瀚微营收 14.63 亿,同比增长 112.66%,归母净利润 3.50 亿,同比增长 1419%。
30 亿参数的 π0 在 RTX 4090 上 KVcache 预填充就要 46ms,远超 20ms 控制周期,7B 的 OpenVLA 8bit 量化后在 A5000 上只剩 1.2Hz,VLA 推理延迟成为灵巧手实时控制的瓶颈。
作者借纪录片《超级工程—曙光8000》第三集《立中枢》,解读郑州曙光8000(登峰)十万卡AI超集群的工程细节:1500吨设备、68000根光缆装进2000余平方米三层建筑,光缆首尾相连超3500公里。
推荐理由:文章借纪录片拆解十万卡集群的供电、装配与光缆插接细节,把机房工程难题类比到日常硬件调试,便于从业者迁移理解。
文章指出 RTOS 与 Linux 的核心差异不是速度而是确定性,实时性指结果能否在 deadline 前可预测地交付。
推荐理由:文章把实时性拆成确定性而非速度,用延迟链路、代码对照和选型决策图给出可直接落地的评估框架。
作者结合 Linux 内核收到 AI 生成的 prom21-xhci 驱动补丁和 EmbedAgent(ICSE 2026,arXiv:2506.11003)基准,分析 AI 在嵌入式开发中的实际边界。
推荐理由:原文结合内核补丁案例与 EmbedAgent 基准数据,给出可直接对照的 AI 分工清单,便于工程师判断哪些活可交出去。
小米开源委员会主席张铎在开放原子生态大会上公布 openvela 累计装机 1.8 亿台。文章回顾了 openvela 的底座 NuttX 及其创始人 Gregory Nutt 的经历。
推荐理由:文章梳理了 NuttX 创始人经历与 openvela 装机数据,可帮助读者理解 POSIX 兼容 RTOS 的产业位置。
机器人安全正从"故障时是否安全"转向"攻击者篡改感知与决策时是否安全",训练后门、系统漏洞与运行时感知操纵构成三层攻击面。NeurIPS 2025 的 BadVLA 针对 VLA 模型植入后门,GoBA 以咖啡杯等日常物品为触发器实现 97% 攻击成功率;UniPwn 利用硬编码密钥与命令注入可"蠕虫式"扩散至整机队。