一篇题为《VEX-Bench: Benchmarking LLM Agents for Assessing Exploitability of Software Supply Chain Vulnerabilities》的新论文已被 EMNLP 2026 接收。该研究介绍了 VEX-Bench,这是一个旨在评估 LLM 代理识别和利用软件供应链中漏洞能力的基准。这项工作旨在通过提供一种标准化的方法来评估 LLM 代理的安全影响,从而推动人工智能驱动的网络安全领域。 AI
影响 该基准可以通过更好地评估 LLM 代理识别漏洞的能力来提高软件供应链的安全性。
排序理由 该集群报告了一篇研究论文被会议接收的情况。
在 Mastodon — sigmoid.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →