一个新的名为ExploitGym的基准测试已被开发出来,用于评估AI代理将安全漏洞转化为实际exploit的能力。该基准测试包含了来自Google V8和Linux内核等不同领域的898个真实世界漏洞案例。对包括Anthropic的Claude Mythos Preview和OpenAI的GPT-5.5在内的先进AI模型的初步测试表明,它们成功利用了一些漏洞,凸显了AI驱动攻击的日益增长的潜力。 AI
影响 该基准测试将通过评估模型的exploit能力,帮助研究人员开发出更好的防御AI驱动的网络攻击的对策。
排序理由 该集群描述了一个用于评估AI代理安全利用能力的新的基准测试论文的发布。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — sigmoid.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →