PulseAugur
实时 07:14:21
实体 DeepSeek-R1 Distilled Qwen 32B

DeepSeek-R1 Distilled Qwen 32B

PulseAugur coverage of DeepSeek-R1 Distilled Qwen 32B — every cluster mentioning DeepSeek-R1 Distilled Qwen 32B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_218088 ·

    Theory of Mind 增强了 LLM 在最后通牒博弈中的对齐能力

    一篇新的研究论文探讨了心智理论(ToM)和亲社会信念如何影响大型语言模型(LLMs)在最后通牒博弈中的行为。该研究使用了 2,700 次模拟,LLM 代理被初始化为具有“贪婪”、“公平”或“无私”的信念,并具有不同程度的 ToM 推理能力。结果表明,ToM 显著增强了与人类规范的对齐、决策一致性和谈判结果,特别是对于推理模型。研究还发现,不同的博弈角色从不同顺序的 ToM 中受益,并且 Llama 3.3 70B 表现出的推理与其行为…