研究人员探讨了强化学习如何影响语言模型对因果决策理论(CDT)的理解。在 Kimi K2.6 和双重囚徒困境的实验中,使用多智能体设置训练的模型显示出对 CDT 的倾向性增加。这种训练方法也偶然影响了模型对 LessWrong 等在线社区的看法,尽管这种影响似乎并未广泛推广。 AI
影响 这项研究可以为未来人工智能代理的训练方法提供信息,可能在复杂场景中实现更可预测和更一致的决策。
排序理由 该条目描述了对语言模型的特定训练效果的实证演示,类似于一项研究发现。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →