PulseAugur
中
实时 09:34:01
实体 Robust Async-Fed-Q

Robust Async-Fed-Q

PulseAugur coverage of Robust Async-Fed-Q — every cluster mentioning Robust Async-Fed-Q across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_284586 ·

    新算法解决了联邦强化学习中的对抗性智能体问题

    研究人员开发了Robust Async-Fed-Q,这是一种新颖的联邦强化学习算法,旨在即使在某些智能体采取对抗性行为的情况下也能保持协作学习效率。这种基于epoch的方法结合了单个智能体处的方差缩减估计和中央服务器处的鲁棒聚合。该算法提供了理论保证,表明协作的好处在诚实智能体之间得以保留,对抗性智能体的影响随着诚实智能体数据的增加而减小,最终在无限样本极限下消失。该工作还建立了信息论下界,实现了对抗鲁棒联邦强化学习的近乎匹配的上界和下界。