研究人员开发了一个新的理论框架和算法,用于在面临隐藏拜占庭攻击的合作多智能体系统中进行在线安全学习。研究指出,攻击者的信息获取方式,无论是观察计划行动还是盲目行动,都决定了系统的模型复杂度。该研究建立了安全学习的信息论极限,证明了即使在直接回报遗憾为零的情况下,不可避免的遗憾也与累积响应差距相关。提出了一种具有已证明遗憾界的算法,为在这种对抗条件下可靠的多智能体系统奠定了基础。 AI
影响 为多智能体系统中安全的合作控制提供了理论基础,与先进的AI应用相关。
排序理由 该集群包含一篇详细介绍多智能体系统和安全理论研究的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- Byzantine attacks
- CatalyzeX Code Finder for Papers
- CORE Recommender
- DagsHub
- Gotit.pub
- Hugging Face
- IArxiv Recommender
- Influence Flower
- Markov decision process
- multi-agent systems
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →