实体
TF-IDF SVM
TF-IDF SVM
PulseAugur coverage of TF-IDF SVM — every cluster mentioning TF-IDF SVM across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新基准 RAG-PIBench 评估 RAG 系统中的提示注入检测
研究人员开发了 RAG-PIBench,这是一个旨在评估检索增强生成 (RAG) 系统中提示注入检测有效性的新基准。该基准包含跨越不同训练、验证和测试集的 4,876 个上下文示例,并采用了带泄露感知的构建过程。评估显示,DistilBERT 模型取得了最高性能,F1 分数为 0.896,PR-AUC 为 0.968,尽管传统的 TF-IDF SVM 和逻辑回归等方法也显示出具有竞争力的结果。
-
新的MaliciousSkillBench数据集解决了代理技能安全风险 · 跟踪2个来源
一个新的基准MaliciousSkillBench已被开发出来,用于检测恶意代理技能,这些技能可以扩展LLM代理并赋予其潜在的有害能力。该基准整合了来自13个公共来源的数据,形成了一个包含9,740个技能(7,505个恶意和2,235个良性)的数据集,以解决现有恶意技能数据集碎片化的问题。对各种检测方法的评估,包括学习到的文本检测器和现成的扫描器,显示虽然一些方法实现了高召回率,但它们常常在假阳性或跨来源评估方面遇到困难,这表明需要更…