PulseAugur
实时 09:15:32
实体 Structurally-Tiered Reward Function

Structurally-Tiered Reward Function

PulseAugur coverage of Structurally-Tiered Reward Function — every cluster mentioning Structurally-Tiered Reward Function across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_165010 ·

    新方法利用风格化触发器增强 VLM 越狱

    研究人员开发了一种名为对抗性风格优化(ASO)的新方法,以增强针对多模态大语言模型(MLLMs)的越狱攻击。ASO 利用基于组相对策略优化(GRPO)的代理来微调图像编辑模型,然后该模型对对抗性图像应用风格化修改。这种方法利用了 MLLMs 中发现的一种风格化不一致性,即它们的安全机制容易受到特定视觉风格的影响,即使内容被理解。实验表明,ASO 显著提高了现有攻击的成功率,突显了风格化偏差是红队测试 MLLMs 的可扩展向量。