PulseAugur
实时 11:12:00
English(EN) CRAX: Fast Safe Reinforcement Learning Benchmarking

新的CRAX基准测试加速了安全强化学习的评估

研究人员推出CRAX,这是一个旨在加速安全强化学习(RL)代理评估的新基准测试。CRAX使用MuJoCo XLA物理引擎构建,与基于CPU的基准测试相比,速度提升高达100倍,使其适用于机器人和自动驾驶等现实世界应用。该基准测试包含六个环境套件和三个特定代理任务,每个都有不同的难度级别。对六种流行的安全RL方法的初步评估表明,没有一种方法是普遍优越的,突显了性能和安全之间的权衡,并表明课程学习可以提高在更具挑战性场景中的性能。 AI

影响 能够为机器人和自动驾驶等现实世界应用中的安全AI进行更快、更具可扩展性的研究。

排序理由 该集群描述了在arXiv上发布的一个用于强化学习研究的新基准测试。

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

新的CRAX基准测试加速了安全强化学习的评估

报道来源 [2]

  1. arXiv cs.AI TIER_1 English(EN) · Tristan Tomilin, Mourad Boustani, Mickey Beurskens, Thiago D. Sim\~ao ·

    CRAX:快速安全的强化学习基准测试

    arXiv:2606.20376v1 Announce Type: cross Abstract: Safety is a core concern for deploying reinforcement learning (RL) agents in real-world domains such as robotics and autonomous driving. While benchmarks have been central to progress in RL, existing safety benchmarks with high-fi…

  2. arXiv cs.AI TIER_1 English(EN) · Thiago D. Simão ·

    CRAX:快速安全的强化学习基准测试

    Safety is a core concern for deploying reinforcement learning (RL) agents in real-world domains such as robotics and autonomous driving. While benchmarks have been central to progress in RL, existing safety benchmarks with high-fidelity 3D physics remain computationally slow, lim…