PulseAugur
实时 08:59:14
English(EN) Quokka: Accelerating Program Verification with LLMs via Invariant Synthesis

LLM在程序验证研究中展现潜力 · 跟踪2个来源

两篇新研究论文探讨了大型语言模型(LLM)在程序验证中的应用。第一篇论文研究了LLM内部表征在判断代码正确性方面的鲁棒性,发现从模型内部提取的信号可以在不执行测试的情况下评估候选解决方案,尽管没有一种单一配置被证明是最优的。第二篇论文介绍了Quokka,一个通过合成循环不变式来加速程序验证的框架,证明了Quokka在源自SV-COMP的基准测试上,其性能始终优于先前的基于LLM的验证器。 AI

影响 这些论文强调了在程序验证中使用LLM的进展,可能加速软件开发并提高代码的可靠性。

排序理由 两篇在arXiv上发表的学术论文,详细介绍了LLM在程序验证应用方面的新研究。

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

LLM在程序验证研究中展现潜力 · 跟踪2个来源

报道来源 [2]

  1. arXiv cs.AI TIER_1 English(EN) · Francisco Ribeiro, Sohaila Abdulsattar, Renata Gonzalez, Mahmoud Kassem, Sarah Nadi ·

    关于大型语言模型内部代码正确性表征的鲁棒性研究

    arXiv:2608.08266v1 Announce Type: cross Abstract: Code generated by modern language models often reads naturally. Yet, it also often fails to implement what was asked. This should be no surprise, as research shows the models' own confidence signals are poorly calibrated with actu…

  2. arXiv cs.AI TIER_1 English(EN) · Anjiang Wei, Tianran Sun, Tarun Suresh, Haoze Wu, Ke Wang, Alex Aiken ·

    Quokka:通过不变式合成利用大型语言模型加速程序验证

    arXiv:2509.21629v4 Announce Type: replace-cross Abstract: Program verification relies on loop invariants, yet automatically discovering strong invariants remains a long-standing challenge. We investigate whether large language models (LLMs) can accelerate program verification by …