PulseAugur
实时 09:51:51
实体 Nash equilibria, gale strings, and perfect matchings

Nash equilibria, gale strings, and perfect matchings

PulseAugur coverage of Nash equilibria, gale strings, and perfect matchings — every cluster mentioning Nash equilibria, gale strings, and perfect matchings across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
4
90 天内 12
发布 · 30天
0
90 天内 0
论文 · 30天
4
90 天内 12
层级分布 · 90 天
主题
关系
情绪 · 30 天

4 天有情绪数据

最近 · 第 1/1 页 · 共 12 条
  1. TOOL · CL_227180 ·

    新学习方案APLA被引入用于噪声博弈优化

    本文介绍了一种新颖的学习方案,称为基于期望的扰动学习自动机(APLA),用于处理具有噪声效用测量的博弈中的分布式优化。APLA通过引入反映玩家满意度水平的期望因子来增强标准强化学习,旨在提高收敛到理想纳什均衡的效率。该研究为APLA在多玩家正效用博弈中的随机稳定性进行了分析,建立了无限维和有限维马尔可夫链之间的等价性。

  2. RESEARCH · CL_222868 ·

    研究发现:人工智能代理可能在电力市场中学会串通

    一项新的研究论文探讨了人工智能代理在算法电力市场中进行默示串通的可能性。该研究由Georgios Tsaousoglou撰写,将战略性竞价建模为一个重复博弈,并使用多智能体强化学习来模拟代理行为。研究结果表明,人工智能代理可以学会维持超竞争性结果,即使没有明确的指示,也表现出默示串通的迹象。

  3. TOOL · CL_206455 ·

    BRAID模型使用图神经网络加速博弈均衡计算

    研究人员开发了BRAID,一种利用权重绑定的迭代图神经网络来高效计算相互依赖安全(IDS)博弈中纳什均衡的新型模型。与需要数百次迭代的传统方法相比,该方法显著加快了过程,每个实例的计算速度提高了43倍。BRAID旨在学习从博弈参数到均衡努力配置的直接映射,从而实现更快的审计、压力测试和激励设计。该模型的架构可适应各种IDS规范,包括不同的成本曲率和邻域聚合方法,并且它还展示了在响应参数扰动时恢复均衡努力如何变化的能力。

  4. TOOL · CL_194173 ·

    用于自动驾驶路由市场的新竞争性中介博弈框架

    本文介绍了竞争性中介博弈,这是一个用于分析市场均衡的新框架,特别适用于自动驾驶路由和驾驶(ARAD)服务。这些博弈是相关均衡的推广,并被证明是算法无悔学习动态的极限。研究表明,在具有市场份额最大化中介的匿名拥堵博弈中,当一个中介被所有用户弱优先时,所有竞争性中介均衡都会导致垄断。作者还概述了ARAD市场并讨论了未来的机制设计。

  5. TOOL · CL_165127 ·

    新框架在混沌博弈动力学中发现统计规律

    研究人员开发了一个新的框架,利用遍历论中的自然不变测度来分析博弈论中的混沌动力学。这种方法可以对诸如乘法权重更新(MWU)等算法的长期行为进行统计表征,即使它们没有收敛到纳什均衡。该研究表明,通过融合博弈论和动力学系统的概念,该方法可以精确计算各种经济指标(如收益和社会成本)的时间平均值。

  6. RESEARCH · CL_153902 ·

    博弈论求解器的“曲率阴影”伪影被解释为可移除的熵不足

    研究人员在博弈论求解器(特别是正则化纳什动力学 R-NaD)中发现了一种伪影,该伪影导致最大熵均衡选择出现明显的失败。这种被称为“曲率阴影”的现象在库恩扑克中被观察到,其中 R-NaD 选择的策略与理论上的最大熵解决方案略有不同。该研究定量地证明,这种差异是与熵景观曲率相关的可移除的不足,而不是固定的偏差,并且得到了实验数据的支持。

  7. RESEARCH · CL_141184 ·

    新研究论文揭示博弈论均衡悖论

    一篇新研究论文挑战了算法博弈论的基础概念,特别是纳什均衡和无政府成本(PoA)。研究表明,静态均衡概念掩盖了动态失衡和博弈论界限,在某些条件下会导致代数敏感性和无界PoA。研究还表明,常见的学习动态可能导致混沌极限集和指数级恶化的效率低下,这表明需要重新评估动态基础度量的最坏情况均衡框架。

  8. RESEARCH · CL_111232 ·

    新框架“参数化开源博弈”连接连续与离散博弈论

    研究人员推出“参数化开源博弈”(Parametric Open Source Games),一个将开源博弈论扩展到连续域的新框架。该方法允许智能体选择参数向量,然后将其映射到有限博弈中的混合策略,为程序均衡提供了连续的类比。研究建立了均衡存在性结果,并探讨了内部参数化如何影响学习动态和均衡结构,有可能将自私优化导向合作结果。

  9. RESEARCH · CL_84347 ·

    新的Phi-Actor-Critic框架将AI代理引导至高效均衡

    研究人员开发了一个名为Phi-Actor-Critic ($\Phi$-AC) 的新框架,以应对多智能体强化学习中的挑战。该方法旨在将学习引导至一般和博弈中的帕累托最优相关均衡,在这种博弈中,个体激励可能与集体福利相冲突。$\Phi$-AC 利用交换后悔最小化和中心化注意力评论员,使反事实后悔估计更易处理,从而能够学习稳定且高效的协调策略。

  10. TOOL · CL_66062 ·

    Federated learning model explores client self-interest and equilibrium transitions

    研究人员开发了一个潜在博弈框架来模拟客户出于自身利益行事的联邦学习场景。该模型分析了客户在服务器奖励影响下的理性训练选择如何导致纳什均衡。研究表明,这些均衡会随着关键奖励因子发生非线性转变,可能导致客户在低努力和高努力水平之间切换。该论文还验证了该关键因子在联邦学习训练中的有效性。

  11. TOOL · CL_22059 ·

    新算法支持在可部分观察马尔可夫博弈中独立学习纳什均衡

    研究人员开发了一种用于可部分观察马尔可夫博弈(POMGs)中智能体的独立学习算法。该算法允许智能体在没有直接通信或完全状态观察的情况下学习近似纳什均衡。该方法侧重于具有独立状态转移和近势马尔可夫博弈的POMGs的一个特定子类,实现了准多项式复杂度。

  12. RESEARCH · CL_11491 ·

    新原理统一贝叶斯推理、博弈论和热力学

    一篇新论文提出了博弈论自由能原理,这是一个统一贝叶斯推理、博弈论和热力学的框架。该原理表明,最小化局部自由能的多智能体系统会隐式地实现随机博弈。研究表明,在某些约束条件下,集体自由能的驻点与近似纳什均衡一致。此外,它通过将合作博弈表示为变分问题,建立了贝叶斯推理与策略互动之间的联系。