PulseAugur
实时 02:13:20
实体 maxims of conversation

maxims of conversation

PulseAugur coverage of maxims of conversation — every cluster mentioning maxims of conversation across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. RESEARCH · CL_193014 ·

    研究发现,大型语言模型在辩论生成方面表现出色,但在评估方面存在困难

    一篇研究论文详细介绍了 DS@GT ARC 在 Touché 2025 检索增强辩论任务中的提交内容,该任务涉及使用来自三个供应商的六个领先的大型语言模型 (LLM)。该任务包括生成辩论发言并根据会话准则对其进行评估。研究发现,虽然前沿 LLM 在生成响应方面非常有效,并且在充当评估者时在其模型家族内部表现出高度一致性,但这种内部共识并不能可靠地预测官方评估性能,尤其是在“质量”准则方面。

  2. TOOL · CL_128838 ·

    研究发现:大型语言模型表征用户意图优于实际行动

    研究人员发现,大型语言模型内部对用户沟通意图的表征比其外在行为所显示的更为稳健。尽管模型经常根据表面文本而非潜在意图进行响应,但通过线性探针可以准确地从不同架构模型的隐藏状态中解码出这种意图。这种内部表征比最初看起来更细致,能够泛化到语用推断的意图,并区分不同类型的支持。虽然模型能够可靠地表征意图,但其对意图的实际行动却不一致且因模型而异,这表明是读取(readout)而非表征(representation)方面存在缺陷。