PulseAugur
中
实时 06:33:07
实体 Mafia

Mafia

PulseAugur coverage of Mafia — every cluster mentioning Mafia across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
4
90 天内 5
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 5 条
  1. TOOL · CL_282170 ·

    “杀手游戏”中的LLM代理展示了沟通在集体推理中的复杂作用

    研究人员利用“杀手游戏”作为试验场,探索了沟通策略如何影响自适应大型语言模型社会中的集体推理。研究发现,与沉默相比,同时广播沟通在各种规模和组成的群体中都能提高识别对手的能力。然而,随着群体规模的扩大和时间的推移,这种优势会减弱,因为代理会调整它们的策略,有时会导致比沉默群体更差的表现。由代理重写和继承策略笔记驱动的适应过程表明,沟通的价值与其产生的演变信号交织在一起。

  2. TOOL · CL_207348 ·

    AI模型在“黑手党”游戏中难以可靠地检测欺骗行为

    一项调查语言模型在“黑手党”游戏中检测欺骗能力的研究表明,模型的性能极易受到随机性的影响,尤其是在游戏早期阶段。GPT OSS 20B和Qwen3-4B等模型的初步排名显示,由于样本量小,结果差异很大,参数数量最初似乎会影响结果,但最终被证明并不可靠。研究强调,该游戏固有的随机性,尤其是在第一天,使得AI模型在欺骗检测任务中难以建立一致的性能基线。

  3. MEME · CL_205105 ·

    Mafia 开发者称 GTA 比较只是“互联网上的事情”

    游戏开发工作室 Hangar 13 的负责人表示,在游戏开发过程中,从未讨论过将他们的游戏“Mafia”与“Grand Theft Auto”系列进行比较。他认为,这些比较主要源于粉丝在互联网上的讨论,而非开发团队内部的对话。

  4. TOOL · CL_177759 ·

    大语言模型通过自定义路由架构玩对话游戏

    本文详细介绍了创建能够玩“狼人杀”和“阿瓦隆”等复杂游戏的对话式人工智能代理的技术实现。作者解决了确保良好用户体验、可重玩性以及在游戏规则内管理 AI 幻觉等挑战。技术解决方案涉及一个充当路由器的“游戏主持人”,以模拟一个群聊环境,让多个大语言模型可以进行交互,从而克服了典型的用户-助手对话结构。

  5. RESEARCH · CL_177334 ·

    新研究应对LLM代理漏洞,从安全基准到高级防御

    近期研究探索增强大型语言模型(LLM)代理的可靠性和安全性。一项研究引入了DiagChain,一个用于评估LLM代理在网络安全攻击链重建方面的基准,揭示即使是先进模型在证据整合和排序方面也存在困难。另一篇论文MAFIA展示了一个仅查询的攻击框架,该框架利用LLM代理中的内存模块,在逃避检测的同时取得了高成功率。为了对抗这些漏洞,正在开发新方法,包括一个经过验证的工具调用包装器,它提高了在非原子故障下的可靠性,以及一个名为$S^3$的多…