研究人员开发了一种新的方法来训练 AI 模型预测 Python 代码中的软件漏洞,特别关注通用弱点枚举 (CWE) 分类法。他们发现,直接使用层级惩罚作为训练信号,尤其是在强化学习中,在分布变化下显著优于监督方法。该方法在特定数据集上成功将 Qwen2.5-Coder-7B 模型的惩罚降低了 25% 以上,达到了与更大规模的零样本模型相当的性能。 AI
影响 这项研究可能带来更强大的 AI 工具来识别和缓解软件漏洞,从而提高代码安全性。
排序理由 该集群包含一篇详细介绍 AI 模型训练新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →