PulseAugur
实时 19:55:27
实体 LLM raters

LLM raters

PulseAugur coverage of LLM raters — every cluster mentioning LLM raters across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_147510 ·

    自动代理红队测试提高了 MLLM 的鲁棒性

    研究人员开发了一个自动框架,用于生成困难示例,以测试和提高多模态大型语言模型 (MLLM) 的鲁棒性。该代理红队测试系统使用多代理架构,包括一个高推理能力的 Architect 代理和 LLM 评估员,以自主发现突破边界的违规行为和模糊的策略边缘情况。通过使用这些合成的对抗性示例,该系统在没有人工干预的情况下,将公开图像安全基准的错误否定率 (FNR) 从 41.2% 降低到 24.5%。