跳到正文
热点事件观察中

HARL-A 对抗多智能体强化学习基准框架发布

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

HARL-A 作者团队发布基于 IsaacLab 的开源框架 HARL-A,用于在高保真物理仿真中对形态各异的机器人团队进行可扩展的对抗策略训练与基准评测,团队数量和每队机器人形态组合均可任意配置。 该框架扩展了 HARL 算法库,提供 Sumo、Soccer、3D Galaga 三个基准环境,分别覆盖接触密集的推挤、球技竞争与追逃场景,并附带超过十个覆盖同构与异构队伍配置的预训练策略,已在 Hugging Face 公开发布,代码、环境、策略与文档均可直接获取。作者称演示中可稳定产生对抗策略与涌现的角色分工。

AI 根据报道生成 · 1 天前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv cs.RO 机器人学
    HARL-A:基于 IsaacLab 的异构多智能体对抗强化学习基准框架

    HARL-A 是一个基于 IsaacLab 的开源框架,支持在高保真物理仿真中对形态各异的机器人团队进行可扩展的对抗策略训练与基准评测,团队数量和每队机器人形态组合均可任意配置。该框架扩展了 HARL 算法库,贡献了模块化软件架构、Sumo/Soccer/3D Galaga 三个基准环境,以及超过十个预训练策略,已在 Hugging Face 公开发布,演示中可稳定产生对抗策略与涌现的角色分工。

本事件热度走势

可比范围当前
4
可比范围峰值
1010月7日 13:00
近 24 小时变化
-50%

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。