PulseAugur
实时 17:47:34
English(EN) Superhuman AI for Generals.io Using Self-Play Reinforcement Learning

超级人工智能代理使用自玩 RL 主导 Generals.io

一篇新的研究论文详细介绍了为实时战略游戏 Generals.io 创建的超级人工智能代理。该代理在高端 GPU 上训练了四天,在超过 5,000 名人类玩家中达到了最高排名,并展示了对顶尖人类竞争对手的显著胜率。通过一个高度优化的、原生 JAX 的模拟器实现了这一开发,该模拟器达到了每秒数千万帧的速度,极大地减少了训练的数据瓶颈。 AI

影响 展示了自玩强化学习和优化模拟器在复杂战略游戏中实现超人性能的有效性。

排序理由 研究论文详细介绍了一种新颖的人工智能代理及其在游戏中的表现。

在 arXiv cs.LG 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

超级人工智能代理使用自玩 RL 主导 Generals.io

报道来源 [2]

  1. arXiv cs.LG TIER_1 English(EN) · Martin Schmid ·

    Generals.io 的超人类 AI 使用自玩强化学习

    We present a superhuman AI agent for Generals.io, a real-time strategy game that requires both long-horizon planning and short-term tactics under strong imperfect information. Trained for four days on 4x NVIDIA H200 GPUs, our agent reaches #1 on the public 1v1 leaderboard of over…

  2. r/MachineLearning TIER_1 English(EN) · /u/shrekofspeed ·

    我用自我博弈强化学习训练了一个超人的 Generals.io 代理 [P]

    <!-- SC_OFF --><div class="md"><p>Hi everyone,</p> <p>I trained a self-play RL agent for <a href="http://Generals.io">Generals.io</a> that reached superhuman-level and ranked #1 on the human 1v1 leaderboard.</p> <p>It began as my master's thesis where the goal was to beat a prior…