爱芯元智AX8850与瑞芯微RK3588端侧AI实测对比与选型分析
文章对比爱芯元智AX8850与瑞芯微RK3588在端侧AI推理上的实测表现,引用双方官方benchmark数据,AX8850在YOLOv5s、YOLOv8n等模型上FPS达到RK3588单核的7~12倍。
推荐理由:原文用双方官方benchmark的同模型FPS对比,把标称TOPS与实际推理性能的差距讲清楚,可迁移为选型时看实测数据的方法。
文章对比爱芯元智AX8850与瑞芯微RK3588在端侧AI推理上的实测表现,引用双方官方benchmark数据,AX8850在YOLOv5s、YOLOv8n等模型上FPS达到RK3588单核的7~12倍。
推荐理由:原文用双方官方benchmark的同模型FPS对比,把标称TOPS与实际推理性能的差距讲清楚,可迁移为选型时看实测数据的方法。
新型决策模型 Jev 数周前发布,专注分类与决策任务,无法写出任何句子,但可极快地完成分类与归类。它接受文本输入,仅输出浮点数,作为用户指定的 yes/no 问题、选项列表和评分请求的答案。Simon Willison 总结了 Jev 的做法,Kev 与 Nimble 等同类模型也已出现,Nimble 刚被 Ollama 支持,体积小到可相对轻松地本地运行。
FCC 于 7 月将外国产先进机器人设备列入构成国家安全或安全风险的清单,新设备无法获得进口、在美销售所需的 FCC 认证,涵盖人形与四足等可采集环境信息的移动机器人。
推荐理由:文章梳理了FCC限制如何从采购传导到机器人架构选择,对评估本地推理与供应链策略有参考价值。
文章认为AI会取代把需求翻译成能跑代码的工作方式,但工程经验反而更值钱。文中汇总多组实验:大模型在126道嵌入式小练习上最强的DeepSeek-R1只做对55.6%,无硬件反馈时Claude Opus 4.7、Gemini 3.1 Pro等模型十轮内一次都没部署成功;16名资深开发者用AI后实测反而慢了19%,新手测验分数低了17%。
推荐理由:原文汇总了多组大模型写嵌入式代码的实测与对照实验,可用于判断AI在硬件相关任务上的真实边界。
2026年上半年,人形、四足机器人进入焊接展示和试点场景,焊接单元旁开始出现数百TOPS算力的边缘计算平台,竞争焦点转向负责焊缝识别、轨迹规划与工艺决策的焊接大脑。
推荐理由:原文梳理了多家焊接大脑企业的技术路线差异,可帮助理解具身智能向焊接等工艺场景迁移的共性与边界。
曙光8000 国产十万卡 AI 超集群通过"超级隧道"打通网卡、CPU 核心与硬盘之间的直通数据路径,以微控、零中断、零竞争、零拷贝减少计算卡等待数据的开销。配套 GPU 直通存储技术 XDS、BurstBuffer 缓冲层与内存加速层分层承接传输、突发读写与高速访问需求,并延伸至 ParaStor 分布式全闪存储与 FlashNexus 集中式全闪存储产品。
华为在AIDC产业发展大会上发布3D数据中心,采用供冷层、IT算力层、供电层、备电层的垂直四层立体堆叠架构,面向大规模智算集群。小枣君解读称,该设计将电力模块至机柜的供电距离从17米缩短至5米,IT供电容量从76MW提升至168MW,机电预制化率超90%,机电交付周期从6个月压缩至3个月。
推荐理由:原文拆解了四层垂直堆叠架构如何压缩供电距离与交付周期,可作为理解智算基础设施演进的参考。
30 亿参数的 π0 在 RTX 4090 上 KVcache 预填充就要 46ms,远超 20ms 控制周期,7B 的 OpenVLA 8bit 量化后在 A5000 上只剩 1.2Hz,VLA 推理延迟成为灵巧手实时控制的瓶颈。
作者认为即便 ST 已提供 STM32 Model Zoo(含 140+ 参考模型、预训练权重和 Model Zoo Services 的重训、量化、部署流程),针对自己产品仍需重新设计模型。