PulseAugur
实时 06:26:33
实体 Glockner et al.

Glockner et al.

PulseAugur coverage of Glockner et al. — every cluster mentioning Glockner et al. across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_218043 ·

    新框架比较大型语言模型与人类在事实核查中的推理过程

    研究人员开发了一种新颖的基于图谱的框架,用于比较人类和大型语言模型(LLMs)在科学事实核查中的推理过程。该方法将解释建模为推理图谱,将论点与研究背景、发现、谬误和标签联系起来。该框架被用于评估GPT-5、Claude Opus 4.7和Qwen3-32B对84个虚假论点的表现,揭示了每个模型在判决准确性和与人类推理的一致性方面的不同性能特征。