研究人员开发了共识多智能体Transformer(CMAT),一个旨在弥合合作多智能体强化学习(MARL)与分层单智能体强化学习(SARL)的新型框架。CMAT使用Transformer编码器处理大型联合观测空间,并通过分层决策机制解决广泛的联合动作空间问题。该机制自回归地生成一个高级共识向量,使智能体能够在潜在空间中就策略达成一致,并同时生成与顺序无关的动作。在StarCraft II、Multi-Agent MuJoCo和Google Research Football上的实验表明,CMAT的性能优于现有的集中式和顺序式MARL方法。 AI
影响 引入了一种改进多智能体强化学习系统中协调和训练稳定性方面的新方法。
排序理由 详细介绍新框架和实验结果的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- CMAT
- Consensus Multi-Agent Transformer
- Google Research Football
- Multi-Agent MuJoCo
- MARL
- StarCraft II
- Transformer
- Zijian Zhao
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →