研究人员开发了一个新的框架,用于评估用于可验证代码创建的形式化规约的生成。该框架解决了这样一个挑战:虽然定理证明器可以根据规约验证代码,但它们无法确认规约本身是否准确反映了用户意图。提出的评估方法结合了形式有效性、参考相似性和行为充分性,区分了对正确输入的接受和对不正确输入的拒绝。使用现有数据集进行的实验表明,测量范围,特别是像广义树编辑距离这样的度量,显著影响规约的可感知质量,突显了超越单纯证明正确性的全面评估的必要性。 AI
影响 这项研究可以通过确保形式化规约准确捕捉用户意图来提高 AI 生成代码的可靠性。
排序理由 该条目是一篇学术论文,详细介绍了一种新的形式化规约生成评估框架。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- arXivLabs
- CatalyzeX Code Finder for Papers
- Clever
- Connected Papers
- CORE Recommender
- DagsHub
- Generalized Tree Edit Distance
- Gotit.pub
- Hugging Face
- Influence Flower
- Lean
- Litmaps
- ScienceCast
- scite Smart Citations
- Verina
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →