一款新的事实核查工具Grounnel揭示了大型语言模型可靠性方面的一个关键缺陷:模型的解释与其最终判断可能相互矛盾。在一次实例中,该工具正确地指出查尔斯·布考斯基的父亲于1958年去世,但大型语言模型却错误地将“他于1948年去世”的说法标记为“支持”。这个问题源于大型语言模型倾向于在其解释中提供准确信息,但最终却得出错误的结论。Grounnel的开发者实现了代码级检查,以验证模型输出是否与其自身一致,从而提高了准确性,但并未完全消除错误。 AI
影响 凸显了大型语言模型一个关键的可靠性问题,影响了对人工智能驱动的事实核查和信息检索系统的信任。
排序理由 该条目描述了一款新产品/工具及其特定功能。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →