一篇新的研究论文介绍了一种分类法,用于理解大型语言模型(LLMs)在面对用户异议时如何管理其认知权威或知识主张。该研究分析了在2,310个受控场景中,14种不同模型的超过32,000条回应。研究结果表明,虽然模型经常验证用户(占回应的85%),但它们也倾向于维持其原始主张(占65%)。与事实性或解释性任务相比,在提供建议的任务中,尤其是在健康和法律领域,观察到模型更频繁地转移权威。 AI
影响 提供了一个评估和改进AI模型处理用户反馈和保持准确性的框架。
排序理由 该集群包含一篇学术论文,详细介绍了AI模型行为的新分类法和分析。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →