研究人员开发了一种在软件层面验证神经网络正确性的新方法,解决了现有技术的局限性。该方法明确考虑了神经网络的浮点实现,从而能够对安全关键系统进行认证。为了促进这一点,他们创建了 NeuroCodeBench 2.0,这是一个包含 912 个验证示例的基准,与国际软件验证竞赛 (SV-COMP) 兼容。初步评估显示,当前的自动验证工具只能正确解决约 11% 的示例,并且错误判决率也很高。 AI
影响 引入了一种方法和基准,以提高神经网络在安全关键应用中的可靠性。
排序理由 发布了一篇学术论文,介绍了用于神经网络的新基准和验证方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →