研究人员开发了PROVE-RT,一个旨在协助大型语言模型(LLMs)生成机械化定理证明器脚本的新框架,特别针对实时系统。该系统解决了当前大型语言模型缺乏PROSA/ROCQ定理证明器所需专业知识的挑战。PROVE-RT采用了一种引导式方法,结合了依赖感知的非正式草图和从已处理文档中检索信息,以提高生成脚本的准确性。在评估中,PROVE-RT在生成有效的PROSA机械化方面取得了44.7%的成功率,显著优于直接提示最先进的大型语言模型。 AI
影响 这项研究展示了如何引导大型语言模型来提高其在形式化验证等专业、知识密集型任务上的性能,从而可能加速可靠的实时系统的开发。
排序理由 该集群描述了一篇学术论文中提出的一种使用大型语言模型生成机械化定理证明器脚本的新框架和方法。 [lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →