研究人员开发了一种攻击自动化事实核查(AFC)系统的新方法,该方法利用大型语言模型(LLM)使用说服性语言重述主张。这种方法将15种说服技巧分类,并在FEVER和FEVEROUS基准上进行了测试。实验表明,这些说服性攻击显著损害了主张验证的准确性和支持性证据的检索,表明当前AFC系统存在漏洞。 AI
影响 凸显了AI事实核查系统的新漏洞,需要更强大的防御措施来应对LLM驱动的虚假信息。
排序理由 该集群包含一篇详细介绍新研究发现的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →