实体
PatchEval
PatchEval
PulseAugur coverage of PatchEval — every cluster mentioning PatchEval across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
CyberForge框架生成合成数据以训练网络安全LLM代理
研究人员开发了CyberForge,一个旨在为大型语言模型(LLM)代理生成合成安全训练数据的新颖框架。该框架将经过验证的漏洞注入到真实的C/C++软件项目中,确保注入的代码是可编译的,并且漏洞可以被动态触发。由此产生的数据集包含80个项目中的1034个已验证漏洞,显著提高了LLM代理在SEC-bench和PatchEval等安全基准测试上的性能。
-
ContraFix框架通过对比分析改进自动化漏洞修复
研究人员开发了ContraFix,一个旨在增强软件中自动化漏洞修复(AVR)的新框架。该系统利用对比运行时分析从失败和非失败的软件变体中生成证据,从而实现更精确的源级修补。ContraFix还包含一个技能库,用于重用修复策略和改进更正,在SEC-Bench和PatchEval等基准测试中展示了比现有方法更高的语义正确性。