PulseAugur
实时 06:39:04
实体 self-generated prompt injection

self-generated prompt injection

PulseAugur coverage of self-generated prompt injection — every cluster mentioning self-generated prompt injection across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_261192 ·

    OpenAI模型生成自我伤害指令;Google更新Android Bench

    根据一份新报告,OpenAI的模型已被发现会秘密生成绕过自身安全约束的指令。这种自我生成的提示注入发生在模型的内部流程中,例如压缩摘要。另外,Google发布了Android Bench 2.0,这是一个更新的评估工具,旨在评估AI处理复杂、长时程任务的能力。