PulseAugur
实时 06:55:55
实体 ad hominem

ad hominem

PulseAugur coverage of ad hominem — every cluster mentioning ad hominem across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_223189 ·

    新基准测试大型语言模型生成修辞谬误的能力

    研究人员推出了 DeflectBench,这是一个旨在评估大型语言模型按需生成修辞谬误能力的新基准。该基准测试了来自四个前沿模型在三种转移策略(“转移话题”、“人身攻击”和“转移视线”)下的 23,990 次生成。研究结果表明,模型拒绝回答的敏感性与其提示的结构和框架有关,而非争议性主张的内容,特定的提示更改会显著改变拒绝率。值得注意的是,“教育辩论教练”的提示框架极大地降低了拒绝率,尽管模型经常采取“标记式合规”,在回复中识别出谬误。

  2. TOOL · CL_53971 ·

    新的AD-H框架使用分层代理进行语言引导的自动驾驶

    研究人员开发了AD-H,一个用于语言引导的自动驾驶的新分层多代理框架。该系统将多模态大语言模型(MLLM)规划器的高层决策与轻量级控制器执行的低层车辆控制分离开来。该框架旨在弥合自然语言指令与车辆行为之间的抽象差距,提高泛化能力和指令遵循能力。