PulseAugur
实时 11:21:47
实体 LLM-based paraphrasing

LLM-based paraphrasing

PulseAugur coverage of LLM-based paraphrasing — every cluster mentioning LLM-based paraphrasing across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_187423 ·

    新方法增强了对恶意AI指令的检测能力

    研究人员开发了一种检测嵌入文本中的恶意指令的新方法,这种漏洞被称为间接提示注入(IPI)。该方法具有上下文和查询感知能力,优于现有检测器。为了增强对自适应规避攻击的鲁棒性,研究人员实施了两种对抗性训练方法:一种使用基于投影梯度的方法在嵌入空间中进行优化,另一种通过基于LLM的释义来模拟真实世界的攻击。实验表明,该方法优于当前基线,尤其是在对抗自适应攻击方面,尽管最优参数可能因应用领域而异。