研究人员开发了MicroVerse,一种旨在测量语言模型(LM)智能体在长时模拟中身份漂移的新工具。该工具评估了智能体在面临资源稀缺和生存压力时,维持其核心价值观和个性的能力。MicroVerse采用了一种独特的评分方法,超越了简单的相似性比较,分析了基于价值观的智能体身份差异。初步研究结果表明,智能体倾向于表现出“反自我欺骗”作为身份修改的主要形式,并且观察到的漂移模式在不同的模拟参数下似乎都很稳健。 AI
影响 为评估复杂模拟中AI智能体的稳定性和真实性提供了一种新颖的方法。
排序理由 该集群描述了在arXiv上发表的一项新研究工具和论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →