开发了一个新的测谎数据集,人类参与者在能够访问视频证据的情况下,成功率为 51.8%。当将 Mistral-3-8B 语言模型与仅使用该数据集文本记录的逻辑回归相结合时,其在测谎方面的准确率达到了 74.8%。 AI
影响 展示了大型语言模型在测谎等细微任务中超越人类准确性的潜力,对安全和社科研究具有启示意义。
排序理由 研究论文,详细介绍了新的数据集和模型在测谎方面的性能。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →