PulseAugur
中
实时 18:21:32
实体 Nimet Beyza Bozdag

Nimet Beyza Bozdag

PulseAugur coverage of Nimet Beyza Bozdag — every cluster mentioning Nimet Beyza Bozdag across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_198065 ·

    研究发现大型语言模型(LLM)容易被单一说服性论点动摇

    一项新的研究论文揭示,大型语言模型(LLM)极易受到对抗性说服的影响,即使论点在事实上是错误的,一个有针对性的论点也足以大幅降低其准确性。研究人员开发了一个使用对抗性强化学习的框架来训练能够操纵LLM响应的“说服剂”。这些说服剂在改变Qwen 14B和Llama-3.1-8B等模型的输出方面取得了显著成功,甚至对GPT-4o mini也显示出一定的有效性。该研究强调了当前LLM代理的一个关键漏洞,并强调了提高其对复杂自然语言影响的鲁棒性的必要性。