跳到正文
热点事件观察中

SWAP:VLA策略逐步路由框架投稿ICRA 2027

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

Mousumi Das 等四名研究者提出 SWAP(StepWise Action Policy Routing)框架,在机器人执行过程中动态组合多个视觉-语言-动作(VLA)策略,将策略路由建模为离线强化学习问题:训练一个路由 critic,在每个决策步根据当前观测选择最合适的策略,而非整个回合固定使用单一策略。该工作已在 DROID 真实操作任务与 LIBERO 仿真实验上评估,目前投稿至 ICRA 2027 审稿中。

AI 根据报道生成 · 1 天前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv cs.RO 机器人学
    SWAP:面向视觉-语言-动作模型的逐步动作策略路由框架

    SWAP 框架在机器人执行过程中动态组合多个 VLA 策略,将策略路由建模为离线强化学习问题,学习一个路由 critic 在每个决策步根据当前观测选择最合适的策略,而非整个回合固定使用单一策略。

本事件热度走势

可比范围当前
4
可比范围峰值
1010月7日 13:00
近 24 小时变化
-50%

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。