实体
PromptGuard
PromptGuard
PulseAugur coverage of PromptGuard — every cluster mentioning PromptGuard across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新的基准测试CrackedPDFs针对PDF中的隐藏提示注入
研究人员推出CrackedPDFs,这是一个新的基准测试,旨在测试大型语言模型(LLM)系统在PDF文档中嵌入的隐藏提示注入攻击。该基准测试包含超过29,000个生成的PDF,包括恶意和良性文件,用于评估检测方法。初步评估表明,一种考虑文档结构和文本的混合检测模型,其准确性很高,优于仅依赖提取文本或结构信息的模型。
-
GLiNER Guard 在单次推理中统一LLM安全与PII检测
一个名为GLiNER Guard (GLiGuard) 的新系统已被开发出来,用于简化大型语言模型的安全审核和PII检测。这个统一的编码器将多个分类器和NER模型折叠到一次前向传播中,与现有的自回归或碎片化编码器方法相比,显著降低了处理时间和成本。GLiGuard的模式驱动接口允许在不重新训练的情况下动态更改策略,使其成为生产LLM应用程序的更高效解决方案。