跳到正文
今天10月8日周四12 条
  1. Hugging Face 每日论文47

    RunningTab:为 LLM 智能体的直接工作区交互引入环境侧标签页

    RunningTab 提出一种为直接工作区交互(DWI)配备环境侧标签页的框架,由环境记录任务待办项、已读文件摘录及已列出但未打开的文件候选。在三个基准测试、三种 LLM 上的验证中,RunningTab 持续优于普通 DWI 及将记录保存在模型内的基线方法,其标签页通常已包含交付物所需内容。

  2. Hugging Face 每日论文55

    长上下文混合模型机理研究 Part 1.1:从混合注意力到混合位置

    论文提出长上下文混合模型机理系列研究 Part 1.1,聚焦全注意力与 SWA 或 GLA、GDN 等线性注意力变体的混合结构。作者观察到上下文扩展中的跷跷板效应,即线性注意力混合模型更受益于长上下文持续预训练,而 SWA 混合模型在长度外推上表现更好,并将其归因于位置归纳偏置差异;同时指出 SWA 混合模型存在短上下文学习陷阱、短窗口倦怠和长窗口惰性。

  3. Hugging Face 每日论文64

    Long-WAM:扩展世界-动作模型上下文的模型系统框架

    Long-WAM 提出在实时控制约束下扩展因果世界-动作模型上下文的模型系统框架,核心发现是访问历史不等于使用历史,更长历史只有在视频底座经自回归预训练时才显著见效。

    推荐理由:论文用对照实验说明自回归预训练的视频底座才让长历史真正转化为成功率提升,可为世界模型选型提供依据。

  4. Hackaday47

    用 ESP32-S3 小型 AM 发射器让老式收音机继续发声

    一位创客用 ESP32-S3 制作了一台小型 AM 发射器,接收网络电台流后通过 GPIO 脉冲链生成射频信号,让老式电子管收音机重新发声。发射器采用 3D 打印外壳与支架固定的大间距线圈天线,输出频率为 200kHz 的欧洲长波波段,足以被老式收音机接收。作者指出该发射功率下可能不合规,但认为功率极低不会被察觉。

  5. CNX Software62

    Efinix 发布 Sapphire RV64 可配置 RISC-V 软核 SoC

    Efinix 推出 Sapphire RV64 SoC,这是一款面向 Titanium、Topaz 和 Trion(T20 及以上)FPGA 的可配置 64 位 RISC-V 软核,基于 VexiiRiscv,可配置 1 至 4 个核心,主频最高 400 MHz。

    推荐理由:原文列出了主频、缓存、内存支持和外设配置,做 FPGA RISC-V 选型的工程师可据此评估是否替换现有 32 位方案。

  6. 玩转单片机与嵌入式44

    为什么为TinyML自研一款嵌入式AI开发板

    作者为TinyML课程自研了一款嵌入式AI开发板,原因是现成开发板缺少联网模块(如ESP32),且难以在一块板上运行多个与实际产品相关的AI模型(如电机堵转模型)。设计上刻意拿掉WS2812彩灯、舵机/PWM、功耗测量等非必要功能,以简化维护。目标是让学员用同一块板完成数据采集、在STM32上运行模型并接着做联网实验。

  7. 嵌入式Linux60

    爱芯元智AX8850与瑞芯微RK3588端侧AI实测对比与选型分析

    文章对比爱芯元智AX8850与瑞芯微RK3588在端侧AI推理上的实测表现,引用双方官方benchmark数据,AX8850在YOLOv5s、YOLOv8n等模型上FPS达到RK3588单核的7~12倍。

    推荐理由:原文用双方官方benchmark的同模型FPS对比,把标称TOPS与实际推理性能的差距讲清楚,可迁移为选型时看实测数据的方法。

  8. Hugging Face 每日论文47

    AdvSim2Real:在冻结的 Web 世界模型中协同进化任务课程、注入对抗样本与 Web Agent,抵御自适应提示注入

    AdvSim2Real 在冻结的 Web 世界模型中协同进化任务课程、注入对抗样本与 Web Agent,使 4B agent 在有无攻击时完成率均提升,且能力增益可迁移到真实浏览器。在 150 个 Web 任务上,面对未训练过的前沿模型对抗者,AdvSim2Real 将完成率相对基础 agent 提升 33.6%。

10月7日周三
  1. CNX Software58

    DSPi 固件让 Raspberry Pi RP2040/RP2350 变身带 DSP 引擎的 USB 声卡

    DSPi 是面向 Raspberry Pi Pico、Pico 2 及其他 RP2040/RP2350 板卡的音频 DSP 固件,可将其变为带集成 DSP 的 USB 声卡,支持房间校正、有源分频、参数 EQ、时间对齐等功能。

    推荐理由:原文列出了 DSPi 在 RP2040 与 RP2350 上的滤波器数量、通道数和数学引擎差异,便于按硬件选型评估。

  2. Hugging Face 每日论文53

    通过推测执行隐藏端侧级联语音 Agent 的工具调用延迟

    端侧级联语音 Agent 采用推测工具执行方案,通过 Predictor 模块在 ASR 阶段预测工具调用并提前执行、缓存结果注入 LLM prompt,实测 Android 语音助手的中位首音频时间从 5.79s 降至 4.60s,标准差从 3.49s 降至 2.81s。方案用基于规则的校验机制过滤用户自我纠正导致的错误缓存,LLM 仍可直接发起工具调用,最坏情况延迟不高于基线串行流水线。

10月6日周二
  1. IoT物联网技术64

    Meta 开源 Muse Gadgets 硬件开发套件,适配 ESP32 与树莓派

    Meta 开源了 Muse Gadgets 硬件开发套件,包含乐鑫ESP32固件和 Linux SDK,开发者可用几十元的 ESP32 开发板或树莓派为个人桌面 AI Agent Muse 制作物理外设,实现智能家居控制、日程提醒等功能。

    推荐理由:原文给出了硬件BOM成本、固件与Linux SDK分工和刷写绑定流程,想自制Muse外设的开发者可据此评估上手成本。

  2. Hackaday55

    新型 LLM 决策模型 Jev:只输出浮点数、极快极便宜

    新型决策模型 Jev 数周前发布,专注分类与决策任务,无法写出任何句子,但可极快地完成分类与归类。它接受文本输入,仅输出浮点数,作为用户指定的 yes/no 问题、选项列表和评分请求的答案。Simon Willison 总结了 Jev 的做法,Kev 与 Nimble 等同类模型也已出现,Nimble 刚被 Ollama 支持,体积小到可相对轻松地本地运行。

  3. Hackaday55

    SecurePair 让两块 ESP32 用单颗 LED 通过可见光通信

    Luca Soltoggio 让两块 ESP32 用单颗 LED 同时作发射与接收器件,通过可见光完成通信。这套名为 SecurePair 的 Arduino 库用于交换密钥并进行加密通信,也可配合 ESPNow 或 LoRa 使用,典型场景是用光完成配对、用无线传输加密数据。它利用了 LED 同时具备一定光电二极管特性的原理,且参与通信的设备不限于两块 ESP32。

  4. 芯板坊57

    香橙派发布 O1 开发板,基于算能 BM1688,16TOPS 算力并带 SATA 与工业接口

    香橙派发布 O1 开发板,首次采用算能 BM1688,TPU 算力 16TOPS@INT8、32TOPS@INT4,配 8 个 Cortex-A53 核心与 RISC-V C906 协处理器。该板带 SATA3.0、双千兆网口、CAN 与 RS485 等接口,内存可选 8GB 或 16GB,8GB 版 1699 元、16GB 版 2799 元,定位工厂监控等边缘 AI 场景。

    推荐理由:原文给出算力、接口、价格与同类开发板对比,选型时可据此评估边缘AI场景的取舍。

  5. Hugging Face 每日论文55

    WorldSonus:为世界模型实时合成空间立体声的视频到音频框架

    WorldSonus 提出面向世界模型的交互式视频到音频框架,用于实时空间声音合成。其采用流式因果自回归扩散架构,以 0.41 的低实时因子(RTF)生成音频块,并通过音频描述流水线与按块索引的提示调度实现生成中动态控制声音事件,同时用立体声与 ambisonic 数据做空间对齐监督。

  6. The Robot Report57

    FCC 对外国机器人限制或加速机器人转向本地 AI 架构

    FCC 于 7 月将外国产先进机器人设备列入构成国家安全或安全风险的清单,新设备无法获得进口、在美销售所需的 FCC 认证,涵盖人形与四足等可采集环境信息的移动机器人。

    推荐理由:文章梳理了FCC限制如何从采购传导到机器人架构选择,对评估本地推理与供应链策略有参考价值。

10月5日周一
  1. 树莓派官方博客63

    树莓派博客解析 Raspberry Pi 5 上的 Sixfab AI HAT+ 低功耗 CNN、VLM 与 SLM 负载

    树莓派官方博客介绍基于 DEEPX DX-M1M NPU 的 Sixfab AI HAT+,为 Raspberry Pi 5 提供 25 TOPS AI 算力,典型持续 NPU 功耗约 3 W,并保留 CPU 处理相机、应用逻辑与连接。

    推荐理由:原文给出 DX-M1M 与 DX-M1 在 CNN 与 Qwen3-1.7B 上的实测数据和 3 W 功耗口径,可为边缘 AI 加速选型提供对照。

  2. IoT物联网技术56

    用199元开源AI录音卡加FunASR搭建离线语音转写与会议纪要系统

    作者用199元开放协议蓝牙AI录音卡、阿里达摩院FunASR和私有化部署的DeepSeek,搭出一套本地存储、离线识别的语音转写与会议纪要系统,全程数据不上云。

    推荐理由:文章给出录音卡蓝牙协议分层解析和 FunASR 本地部署命令,可迁移到同类离线语音转写系统的搭建。

  3. 新智元64

    魔芯科技MoWorld 4D世界模型落地华为Mate 90,摸小宠应用上线

    魔芯科技的4D世界模型MoWorld随华为Mate 90系列发布进入消费端,鸿蒙独占应用「摸小宠」可将几张手机拍摄的宠物照片生成可任意视角浏览的4D数字猫。技术上采用端云协同,云端昇腾NPU生成3D高斯模型,约6亿参数的MoWorld-2.0-Flash经量化裁剪后跑在麒麟芯片上完成端侧渲染,推理成本约为进口GPU方案的30%。

  4. 立芯嵌入式58

    AI越会写代码,嵌入式工程师为何反而更值钱

    文章认为AI会取代把需求翻译成能跑代码的工作方式,但工程经验反而更值钱。文中汇总多组实验:大模型在126道嵌入式小练习上最强的DeepSeek-R1只做对55.6%,无硬件反馈时Claude Opus 4.7、Gemini 3.1 Pro等模型十轮内一次都没部署成功;16名资深开发者用AI后实测反而慢了19%,新手测验分数低了17%。

    推荐理由:原文汇总了多组大模型写嵌入式代码的实测与对照实验,可用于判断AI在硬件相关任务上的真实边界。

  5. Hugging Face 每日论文55

    LoGRA:用低秩梯度草图扩展 LLM 强化学习训练

    LoGRA 通过低秩梯度草图保留有效学习信号,将 LLM 强化学习后训练的平均训练内存最多降低 45.7%,且不损失性能。该方法配合 predicted-KL 步长控制,在单个八 GPU 节点上稳定训练 27B 参数模型超过 1,100 步,而 dense Adam 会显存耗尽,使原本内存不可行的 RL 训练变得可行。代码已在相关库中开源。

10月4日周日
  1. CNX Software66

    ESP-SDR 固件让 ESP32 免外接硬件变身 2.4/5 GHz 软件定义无线电

    开源 ESP-SDR 固件绕过 ESP32 的 Wi-Fi/蓝牙调制解调器,直接从内部 ADC 信号链采集原始 I/Q 基带采样,无需外接 SDR 硬件即可把 ESP32 变成软件定义无线电接收机。

    推荐理由:固件通过逆向 librftest 的 adctrig 调试寄存器让 ESP32 直采 I/Q,为低成本 SDR 方案提供了可复用的实现路径。

10月3日周六