一篇新的研究论文探讨了提供给语言模型的上下文如何影响其验证阈值。研究发现,在模型的上下文中包含先前的审计修复环节,可以将误报率显著降低9-25%,这种降低在各种模型和措辞组合中均有体现。这种宽松似乎源于模型决策阈值的变化,而非其区分能力的提高。研究表明,将验证器置于它们已执行修复的上下文中可能会导致这种效应,并且修复的内容和审计判决在影响不同模型家族方面起着互补作用。 AI
影响 这项研究强调了上下文操纵如何改变LLM的验证行为,这可能会影响自动化检查流程的可靠性。
排序理由 该集群包含一篇详细介绍LLM行为新研究发现的学术论文。
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →