跳到正文
热点事件持续更新

提出事件对齐视觉动作推理框架

1 篇报道1 个报道来源7 小时前更新

先了解这件事

AI 综述

Xiaomeng Yang 等人在 arXiv 提出一种事件对齐的视觉动作推理框架与执行有效性头,围绕交互事件组织世界动作模型(WAM)的视觉-动作预测:每次想象推演生成事件对齐的视觉上下文,对任务关键状态变化细粒度推理,对连接性过渡粗粒度推进。 论文称实验显示该方法在 DOMINO 上较基线提升 10.26 个百分点的成功率,在 RoboTwin 2.0 上表现有竞争力,并可从 DOMINO Level 1 迁移到 Level 2、3 而无需目标层级适配。

AI 根据报道生成 · 7 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv cs.RO 机器人学
    事件对齐的视觉动作推理框架提升 WAM 在 DOMINO 上的成功率

    论文提出一种事件对齐的视觉动作推理框架,围绕交互事件组织视觉-动作预测,让 WAM 在每次想象推演中生成事件对齐的视觉上下文,对任务关键状态变化给予更细粒度的推理,对连接性过渡则粗粒度推进。

本事件热度走势

可比范围当前
8
可比范围峰值
1010月8日 13:00
近 24 小时变化
–

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。