研究人员开发了 HoarePrompt,一种将程序验证原理与自然语言处理相结合以评估软件正确性的新方法。该方法改编了最强后置条件演算,并使用少样本驱动的 k-归纳技术来处理循环,使大型语言模型能够系统地描述程序状态。HoarePrompt 在 CoCoClaNeL 数据集上进行了评估,与标准的零样本 CoT 提示和基于 LLM 的测试生成相比,在正确性分类方面显示出显著的改进。 AI
影响 增强了 LLM 在形式软件验证方面的能力,有望提高代码质量和可靠性。
排序理由 该集群包含一篇学术论文,详细介绍了使用 LLM 进行程序正确性验证的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →