ESP:单次评估生成多模态动作,时延低于流匹配
热点事件观察中
ESP:单次评估生成多模态动作,时延低于流匹配
1 篇报道1 个报道来源1 天前更新
先了解这件事
AI 综述
Lilika Makabe、Heecheol Kim、Yasuyuki Matsushita 提出 ESP(Energy-Score Policy),一种免蒸馏方法,用单次网络评估把策略上下文与噪声直接映射为动作块,动作头以 energy score 而非均方误差训练,直接学习多模态动作分布,以缓解 VLA 策略迭代采样的推理延迟。 作者称,在仿真与真实操作任务实验中,ESP 的任务成功率与 flow matching 基线相当,而动作生成时延大幅降低。
AI 根据报道生成 · 1 天前更新
最新进展10月7日 12:00
ESP:面向单步多模态动作生成的 Energy-Score Policy报道时间线
沿着报道,了解事件的不同侧面。
10月7日
- arXiv cs.RO 机器人学ESP:面向单步多模态动作生成的 Energy-Score Policy
ESP(Energy-Score Policy)提出一种免蒸馏方法,用单次网络评估将策略上下文与噪声直接映射为动作块,动作头以 energy score 而非均方误差训练,实现对多模态动作分布的直接学习。仿真与真实操作任务实验显示,其任务成功率与 flow matching 基线相当,而动作生成时延大幅降低。
本事件热度走势
- 可比范围当前
- 4
- 可比范围峰值
- 1010月7日 13:00
- 近 24 小时变化
- -50%
02.557.510
18:0010月8日06:0012:0018:00
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。