安全公司 1Password 发布了一份关于 AI 修补软件漏洞能力的基准报告,声称模型仅有 26% 的时间能生成干净的修复方案。然而,Trail of Bits 的详细分析认为这一数字具有误导性。Trail of Bits 指出,1Password 的方法论包括了故意指示 AI 代理应用不正确的修复方案或阻止其测试补丁的实验,这显著地扭曲了结果。在更现实的条件下重新分析 1Password 的数据后,Trail of Bits 发现 AI 模型成功阻止了 86% 的漏洞利用,表明其补丁能力远高于 1Password 的头条新闻所暗示的水平。 AI
影响 具有误导性的基准测试可能会阻碍 AI 在漏洞修复等关键安全任务中的应用。
排序理由 对已发布的基准报告的分析,而非新的发布或事件。
在 Mastodon — sigmoid.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →