Isabelle
PulseAugur coverage of Isabelle — every cluster mentioning Isabelle across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
新的CAPRI系统确保LLM不更改Isabelle证明
研究人员开发了CAPRI,这是一个新颖的工作流程,旨在提高大型语言模型(LLM)为Isabelle定理证明器生成证明的可靠性。CAPRI引入了一个契约感知的修复机制,其中Isabelle验证证明的正确性,而一个独立的检查器强制执行机器可读的编辑契约,以确保LLM仅修改授权的部分。对失败证明的评估表明,CAPRI显著降低了未经授权修改的风险,特别是在关注证明体而不是整个理论时。该系统在各种配置下进行了测试,包括与OpenRouter和O…
-
AI 通过新工具和基准推动形式化证明系统发展 · 跟踪 4 个来源
研究人员为形式化定理证明开发了新工具和基准,该领域与 AI 的相关性日益增强。一篇论文详细介绍了一个用于 Event-B 的交互式序列证明器,该证明器用 Prolog 编码,在教学和证明分析方面具有优势。另一篇论文介绍了 ProB(一个基于 Prolog 的模型检查器)的扩展,用于动画和可视化 Prolog 转换系统,并应用于游戏策略评估和教学。第三项贡献引入了 ITPEval,这是第一个用于在不同交互式定理证明器 (ITP) 之间翻…
-
LLM模组通过动态NPC和涌现式叙事彻底改变RPG
开源大型语言模型(LLM)正在显著提升角色扮演游戏(RPG)的体验,尤其是在支持广泛模组的游戏(如Skyrim)中。CHIM和SkyrimNet等模组利用LLM来创建动态且上下文感知的非玩家角色(NPC),从而实现涌现式叙事和个性化任务线。这使得玩家能够参与更深层次的角色扮演场景,超越预设内容和静态NPC交互的限制。
-
AI工具IsabeLLM已增强,可用于共识协议的正式验证
研究人员通过集成检索增强生成框架,增强了IsabeLLM(一种用于自动定理证明的AI工具)。此次升级包括错误跟踪和反例生成,为大型语言模型提供更好的上下文。更新后的IsabeLLM现已兼容最新版本的Isabelle和Sledgehammer,旨在提高效率。该论文比较了原始和增强版IsabeLLM在验证比特币工作量证明共识协议方面的性能。
-
神经符号AI框架自动化软件验证证明
研究人员开发了一种新颖的神经符号框架,以自动化系统软件验证的证明生成。该方法结合了大型语言模型(LLM)和交互式定理证明(ITP)工具,以更有效地导航证明状态。通过在证明数据上微调LLM,并集成符号ITP工具进行步骤修复和子目标求解,该系统显著增强了证明自动化。