arXiv 上的一项新分析通过将其专家驱动的风险排名与大规模真实 LLM 安全事件语料库进行比较,调查了 OWASP LLM 应用 Top 10 的鲁棒性。研究发现,专家排名与事件数据之间的一致性较弱,Cohen's \u03ba \u2248 0.20。尽管如此,专家排名被证明是鲁棒的,并且真实性检查表明与留出数据有很强的相关性。这项研究是两位工作组成员的探索性分析,不代表 OWASP 的官方发布。 AI
影响 强调了专家判断的 LLM 风险与实际事件数据之间可能存在的差异,表明需要更好地统一安全最佳实践。
排序理由 发布在 arXiv 上的研究论文,分析 LLM 安全风险。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →