算能 tpu-mlir v1.30.2 发布
算能发布 tpu-mlir v1.30.2,新增 chunk prefill 与 chunked decode(含 Qwen3.5 专用版本)、MoE 性能分析 llm_analyse.py 及 FP8 LLM 修复,并支持 MiniCPM-V-4.6、Step3-VL、Falcon-Perception、LocateAnything-3B 等新模型。
技术方向
跑在设备上的智能:边缘 NPU、端侧推理框架、小模型量化部署与功耗优化的进展。
65 条精选近 30 天 60 条共收录 153 条
算能发布 tpu-mlir v1.30.2,新增 chunk prefill 与 chunked decode(含 Qwen3.5 专用版本)、MoE 性能分析 llm_analyse.py 及 FP8 LLM 修复,并支持 MiniCPM-V-4.6、Step3-VL、Falcon-Perception、LocateAnything-3B 等新模型。
文章盘点了芯片原厂与硬件企业在AI Coding领域推出的新工具:乐鑫EIM、MCP服务和ESP-CLAW分别解决环境搭建、官方文档接入和外设技能动态加载;全志ThunderWorkbench把串口。
推荐理由:原文横向梳理了五家厂商的嵌入式AI开发工具定位差异,便于工程师对比选型。
嘉楠发布 CanMV K230 SDK v1.8,重点改进 IDE 调试体验、MicroPython 模块、UART 与 USB 稳定性,并新增 libwebsockets 和 mbedTLS 支持。
推荐理由:版本说明逐项列出 IDE 调试、MicroPython 新模块与 USB 栈改动,升级前可对照评估影响范围。
嘉楠发布 CanMV K230 SDK v1.7,优化 U-Boot 与 RT-Smart 启动时间,并新增 k230d_canmv_lushanpi_lite、k230_canmv_mrt、k230d_canmv_labplus_ai_camera_v2、DongshanPI LPDDR4 与 2GB DDR 等板卡和内存配置。
推荐理由:v1.7 在 U-Boot 与 RT-Smart 两侧同时优化启动时间,并新增多块开发板与内存配置,便于评估平台适配范围。
嘉楠发布 CanMV K230 v1.6,引入 MPP 私有池支持以简化媒体模块交互,并在全系统使用 RISC-V Vector(RVV)扩展做性能优化。该版本新增双摄 AI 示例、sensor 手动对焦与手动曝光 API,支持 k230d_canmv_mini 等新板卡与面板,并加深 LVGL 集成,支持将 sensor 图像直接渲染进 LVGL 控件。
推荐理由:MPP 私有池架构迁移和 RVV 全系统加速是本次版本的主要变化,可帮助开发者评估媒体模块交互与性能收益。