开源墨水屏智能手表 Watchy 基于 ESP32-S3FN8,续航 30 天并支持自定义表盘
开源智能手表 Watchy 软硬件 100% 开源,采用乐鑫 ESP32-S3FN8 主控和 200x200 像素电子墨水屏,续航可达 30 天。它内置 DS3231 高精度 RTC 和 BMA423 三轴加速计,支持步数计数、抬手亮屏、实时天气、番茄闹钟、指南针与蓝牙 Wi-Fi 连接。
开源智能手表 Watchy 软硬件 100% 开源,采用乐鑫 ESP32-S3FN8 主控和 200x200 像素电子墨水屏,续航可达 30 天。它内置 DS3231 高精度 RTC 和 BMA423 三轴加速计,支持步数计数、抬手亮屏、实时天气、番茄闹钟、指南针与蓝牙 Wi-Fi 连接。
2026年上半年,人形、四足机器人进入焊接展示和试点场景,焊接单元旁开始出现数百TOPS算力的边缘计算平台,竞争焦点转向负责焊缝识别、轨迹规划与工艺决策的焊接大脑。
推荐理由:原文梳理了多家焊接大脑企业的技术路线差异,可帮助理解具身智能向焊接等工艺场景迁移的共性与边界。
AAEON 推出 UP Xtreme PTL Edge Air 版本,采用 Frore Systems AirJet 固态主动散热,机身较原版薄 35%、轻 43%,运行噪音低于 21 dBA。
Avaota F2 是首款基于全志 V861 双核 64-bit RISC-V SoC 的开发板,内置 128MB DDR3、支持 4K 摄像头、H.265 编解码和 1 TOPS NPU,面向 AI 相机并支持 PTZ 电机控制与扬声器、双麦克风接口。
推荐理由:原文给出完整规格、开源硬件资料清单与售价,可作为 AI 相机方案选型时的横向比较参考。
NVIDIA 推出开源 C++ 样例集 Do Inference Now (DIN) Deploy,将 ONNX Runtime 与 NVIDIA TensorRT RTX 执行提供程序结合,帮助开发者从模型 checkpoint 走到本地原生应用。该样例集面向本地应用集成 AI 模型,提供可移植模型格式、可靠运行时与跨目标系统的加速支持。
Glimpse 是一款软硬件全开源的摩托车极简导航与仪表设备,基于乐鑫 ESP32-S3 主控和 1.75 英寸 466×466 圆形 AMOLED 屏,通过蓝牙连接 iPhone 调用高德导航,实现定位、地点搜索、路线规划与转向提示同步显示。
推荐理由:原文给出了硬件选型、导航界面元素定义和编译部署步骤,想复刻圆屏导航器的开发者可据此评估工作量。
曙光8000 国产十万卡 AI 超集群通过"超级隧道"打通网卡、CPU 核心与硬盘之间的直通数据路径,以微控、零中断、零竞争、零拷贝减少计算卡等待数据的开销。配套 GPU 直通存储技术 XDS、BurstBuffer 缓冲层与内存加速层分层承接传输、突发读写与高速访问需求,并延伸至 ParaStor 分布式全闪存储与 FlashNexus 集中式全闪存储产品。
SSR(Selection-based Structured Reasoning)框架将多模态搜索智能体的推理从开放式生成改为从预设可复用的自然语言候选中选择,无需辅助任务头。在七个多模态搜索基准上用 2B 和 4B 模型评测,SSR 在多种强化学习目标与监督微调下,每轮推理时延降低超过 90%,每题总模型推理时延降低 28-54%,平均成功率与同规模领先搜索智能体相当。
NVIDIA NeMo Relay 可追踪 Agent Harness 的执行路径,暴露任务完成背后的低效行为。失败搜索触发重复搜索、截断的文件读取导致命令重复抓取同一内容等冗余步骤会增加时延并消耗 token,即使最终答案正确也会被掩盖。这些低效还带来更多失败机会,追踪能力为改进 Agent 行为提供依据。
华为在AIDC产业发展大会上发布3D数据中心,采用供冷层、IT算力层、供电层、备电层的垂直四层立体堆叠架构,面向大规模智算集群。小枣君解读称,该设计将电力模块至机柜的供电距离从17米缩短至5米,IT供电容量从76MW提升至168MW,机电预制化率超90%,机电交付周期从6个月压缩至3个月。
推荐理由:原文拆解了四层垂直堆叠架构如何压缩供电距离与交付周期,可作为理解智算基础设施演进的参考。
30 亿参数的 π0 在 RTX 4090 上 KVcache 预填充就要 46ms,远超 20ms 控制周期,7B 的 OpenVLA 8bit 量化后在 A5000 上只剩 1.2Hz,VLA 推理延迟成为灵巧手实时控制的瓶颈。
立创开源硬件平台转载介绍 songge8 的琛光E1 Nano 超小 ESP32 开源无人机,主控为 ESP32S3-SuperMini,姿态传感器为 MPU-6500,通过 PWM 控制四路 MOSFET 调节电机转速实现平衡飞行,支持自带 WEB 遥控器、APP 和 ELRS/CRSF/SBUS 实体遥控。
推荐理由:给出了硬件清单、调试命令和校准合格范围,想复刻迷你飞控的读者可照着步骤操作。
TICKEY在Kickstarter获7909名支持者、筹资671万港币(85万美金),远超1万港币初始目标。
推荐理由:原文拆解了ESP32-S3加彩色电子纸的软硬件分工与功耗取舍,做类似低功耗显示项目的工程师可参考其架构选择。
文章指出,以在STM32、ESP32、RISC-V MCU上运行AI模型为目标的嵌入式工程师,完全没必要先花几个月系统学Python。作者认为真正需要掌握的只是基础语法、NumPy数组与shape/reshape等维度概念,以及Pandas读CSV、Matplotlib看波形、TensorFlow/Keras的简单模型定义与训练代码,面向对象高级用法、异步、Web开发等可暂缓。
AI推理优化与AI训练有三个本质区别:计算方向上推理只有前向传播、计算量约为训练的三分之一;优化目标上训练看准确率,推理看延迟、吞吐量与成本;分工上训练属算法工程师,推理优化属系统工程师。推理优化具体包括量化(7B模型FP32需28GB显存,量化后体积缩小4-8倍)、CUDA Kernel优化与调度优化(如vLLM的PagedAttention解决显存碎片化)。
作者建议从一个能在现有开发板上运行的小模型入手,从训练一直做到板端输出,哪里不会补哪里。第一个实验推荐正弦波拟合,输入输出易生成易检查,可集中学习训练、转换和调用流程,TFLM 的 Hello World 示例即提供这条路线。
作者在STM32H743ZIT6上跑通手写数字识别全流程:触摸屏笔迹经Bresenham连线与3×3笔刷栅格化成28×28灰度图,交给14,410参数的CNN本地推理,LCD显示识别结果、置信度和耗时。
推荐理由:原文给出模型结构、量化前后准确率与板端逐字节比对方法,可迁移为MCU部署的验证流程参考。
作者用一个正弦波回归模型完整演示了从 PC 训练到 MCU 推理的链路,部署在 STM32F103RCT6 上,模型文件 2488 B,TFLM Tensor Arena 配置为 2048 B。
推荐理由:原文给出模型结构、量化参数和固件资源占用,可作为 MCU 上跑通回归模型的完整参考流程。
作者在 ESP32 小型应用平台系列第 7 篇中,用腾讯云 COS 承载 index.json 静态目录和签名 .app 安装包,打通生成目录、上传 COS、ESP32 读取 index.json、判断版本、下载、校验、安装的完整链路。
推荐理由:原文拆解了静态目录加签名安装包的两层校验设计,做设备端应用分发的开发者可直接借鉴其发布顺序与下载落盘方案。
单片机上运行数字识别AI模型,实现端侧AI与嵌入式AI的数字识别演示。原文仅以话题标签形式给出这一演示主题,未披露所用芯片型号、模型结构、算力与功耗等具体参数。
瑞萨2026边缘AI技术研讨会(上海&深圳)正式开启报名,上海站定于2026年10月24日13:00–17:30,深圳站定于2026年11月7日13:00–17:30。研讨会将展示RA8、RZ/V系列AI处理器全新应用场景,并设置AI实操实验项目,帮助工程师现场完成第一个hello_world工程和AI模型部署。报名并到场的观众可参与抽奖,前30位现场签到的观众可获得RA MCU开发板。
文章介绍 ESP32 小型应用平台第 6 篇:多个 WASM 小应用共用一块 Flash 时,平台只向应用开放 platform_kv_get 和 platform_kv_set 两个 API,由平台决定数据写入位置。
推荐理由:文章拆解了从命名空间映射到碰撞拒绝的完整隔离链路,做类似多应用共存设计的工程师可直接借鉴其检查顺序与限流参数。
Github 项目 Pocket-Lab-Power-Supply 把实验室电源做进 4S 21700 电池包,输出 1V~20V 步进 100mV、限流 0.1A~5A 步进 50mA,外壳约 10cm。
推荐理由:逐块拆解了原理图与关键芯片选型,想复刻或借鉴电源设计的工程师可直接参考。
文章解读开源项目 audio-reactive-led-strip(Scott Lawson 开发,MIT 协议,GitHub 超 3000 星)的架构:上位机用 PyAudio 采集 44.1kHz 音频并经 NumPy/SciPy 做 FFT 与 24 阶 Mel 滤波。
推荐理由:原文拆解了上位机与下位机分工架构及 Mel 滤波、I2S DMA 关键细节,做灯效开发的工程师可直接对照选型。
作者介绍其 ESP32 WASM 小应用平台如何限制应用权限:Manifest 声明 display、touch、storage 三种权限并随 .app 一同签名,真正的检查分布在安装校验、WASM 加载、事件分发和每次系统 API 调用中。
推荐理由:原文逐层拆解了 Manifest 声明、API 调用检查和资源配额三层机制,做类似沙箱设计的工程师可直接借鉴其检查落点。
9月22日,龙芯中科发布支持自研通用GPU的龙芯加速计算平台(Loongson Accelerated Computing Platform)首个软件版本,基于龙芯2K3000及9A1000内集成的自研LG200系列通用GPU核心打造,覆盖推理引擎、高性能算子库、专用编译器、运行时环境、调试工具及性能分析套件,支持OpenCL 3.0与CUDA两类编程模型。
推荐理由:原文列出了平台的核心组件、编程模型支持和适配框架,选型国产算力的工程师可据此评估迁移成本。
拿铁熊猫发布新 x86 核心板 Mu Ultra,尺寸与接口沿用上一代 69.6 × 60 mm、260-Pin SO-DIMM,CPU 升级为 Intel Core Ultra 5 226V 或 7 256V,均为 8 核(4P + 4LP-E),配 16GB LPDDR5X-8533 封装内存,NPU 算力 40/47TOPS,总算力 97/115TOPS。
推荐理由:原文列出了两档CPU的跑分、AI推理帧率和新旧载板兼容情况,选型和老用户升级前可据此评估代价。
FluidNC 是由 Grbl_ESP32 核心作者团队重构的开源运动控制固件,GPL-3.0 协议,GitHub 超过 2800 颗星,最新稳定版 v4.1.0,以 ESP32 与 ESP32-S3 为核心平台。
推荐理由:文章梳理了 FluidNC 用 YAML 声明硬件和 I2S 扩展脉冲的做法,做多轴设备选型时可对照其适用边界。
Cactus Compute 展示了 14MB 的 function-calling 模型 Needle 2,可在 Raspberry Pi 5 上仅用 CPU 把自然语言转成本地动作,输入 Turn the LED on 后 78 毫秒点亮 LED。
推荐理由:原文给出完整 Python 代码与各次调用的延迟、内存数据,想在树莓派上做本地 function calling 的人可以直接照着复现。
ST 发布消费级 LSM6DSK320X 与工业级 ISM6HGK256X 六轴 IMU,采用超对称陀螺仪架构抵消外部振动与冲击,并内置双加速度计,可同时测量 ±16 g 低量程与 ±320 g 高量程事件。
推荐理由:双加速度计与超对称陀螺仪架构的细节,可帮助评估无人机等高振动场景的 IMU 选型。
作者为 ESP32 小应用平台设计了 EMAP v1 格式的 .app 应用包,把 WASM 程序、Manifest 说明与签名封装为可安装、可验证的容器。
推荐理由:原文逐层拆解了包格式、Manifest 字段与签名验证流程,做 MCU 应用分发的工程师可直接借鉴这套设计取舍。
立创开源硬件平台转载介绍了一个基于 ESP32-S3 的智能激光量房仪开源项目,可记录距离、测量方向并拍照,自动生成房间轮廓并导出 DXF。设备支持单点测距、P2P 测量、固定测站平面扫描、Wi-Fi 数据同步和 PC 网页工作台,AI 辅助识别门窗插座的推理在 PC 端用 ONNX 模型完成,ESP32-S3 负责图像采集上传。
推荐理由:原文列出了硬件配置、精度数据和499元成本,想复刻的读者可据此评估投入与可行性。
文章讲解STM32项目部署AI模型时内部Flash放不下模型数组的排查与选型方法:先按只读权重、激活缓冲区、输入输出缓冲区、代码与栈四类数据分别估算Flash和RAM需求,再对照内部Flash、外部QSPI/OSPI NOR Flash、外部SDRAM/PSRAM、SD卡四种存放位置的适用场景与检查项。
推荐理由:文章给出容量与RAM的基本式和四类存放位置的对照表,做MCU模型部署选型时可直接照此排查。
作者认为即便 ST 已提供 STM32 Model Zoo(含 140+ 参考模型、预训练权重和 Model Zoo Services 的重训、量化、部署流程),针对自己产品仍需重新设计模型。
作者整理了一套独立开发工具链,除域名外全部用免费额度解决,年成本压到 100 元以内。AI 编程用华为云 CodeArts Agent、阿里通义灵码个人版、GitHub Copilot 免费版(每月 2000 次补全);大模型靠阿里云百炼新用户 7000 万 Token、智谱 2000 万、火山引擎豆包每模型 50 万。
作者为 ESP32 WASM 小应用平台设计了一层受控的系统 API,让应用通过 platform 导入模块请求绘图、时间和键值存储能力,而不直接接触底层硬件。
推荐理由:原文逐条列出绘图调用的权限、配额与边界检查项,做类似受限运行时接口设计时可直接参考。
文章解释了训练好的AI模型如何经STM32Cube.AI转换后在STM32上运行推理。神经网络本质是乘加、比较、移位等确定运算的组合,训练得到的参数与计算流程在推理阶段均已固定,因此可脱离Python执行。STM32Cube.AI解析模型计算图,将权重转为Flash中的数据(如INT8量化的int8_t数组),将各层转为可调用的算子函数,配合CMSIS-NN等优化在MCU上完成推理。
创龙科技RK3588工控机无需更换整机,通过M.2 M Key接口插上AI加速模块,整机算力可从原生6TOPS扩至31TOPS(配DEEPX DX-M1M)或32TOPS(配Hailo-8)。
推荐理由:给出了两种AI加速模块的算力、功耗和YOLOv5s实测帧率,便于评估老项目升级路径。
文章把嵌入式AI编程工具按执行权分为补全型和Agent型两类,并给出三条分派标准:跨不跨文件、要不要跑工具、沾不沾硬件。补全型适合单文件样板代码,Agent型适合跨文件重构和编译报错循环,涉及时序和上板验证的活仍由人完成;文中还介绍了开源项目 embeddedskills,把 Keil、GCC 编译和 J-Link、OpenOCD 烧录封装成 Skill 供 AI 调用。
推荐理由:文章给出按跨文件、跑工具、沾硬件三条标准分派任务的方法,做嵌入式AI编程的人可以直接套用。
作者介绍其 ESP32 小应用平台中 WebAssembly 的运行原理:ESP32 先执行原生平台固件,固件内置 WAMR(WebAssembly Micro Runtime)加载并解释 .wasm 模块,应用再通过宿主接口调用屏幕、触摸、时间和存储能力。
推荐理由:原文把原生固件与WASM小应用的执行链路逐层拆开,并给出资源限制的具体数值,便于评估该方案的可行性。