PulseAugur
实时 10:05:57
实体 Verus

Verus

PulseAugur coverage of Verus — every cluster mentioning Verus across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 5
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 4
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 5 条
  1. TOOL · CL_183343 ·

    新的 RESUME CONTRACT 形式化了 AI 代理工作流的可靠性

    一篇新的研究论文介绍 RESUME CONTRACT,这是一个用于确保 AI 代理工作流可靠检查点和恢复的正式规范。该论文分析了包括 LangGraph 和 CrewAI 在内的五个流行框架,发现它们的实现常常无法满足其自身声明的恢复语义,特别是在效果的“恰好一次”执行方面。研究人员开发了一个 TLA+ 模型来穷尽检查该合同,并提出了一个参考实现 REMIT,其中包括一个 Verus 验证的核心和一个跨进程消费门,以解决这些关键的可靠性问题。

  2. TOOL · CL_128719 ·

    新系统Formal Disco可大规模生成已验证的代码数据集

    研究人员开发了Formal Disco,一个旨在生成大量形式化验证程序数据集的可扩展系统。该系统采用分布式方法,包含三种类型的AI工作者:启动者负责勾画程序,修复者负责解决验证错误,扩展者负责扩展现有代码。Formal Disco旨在通过创建合成数据来克服形式化验证中的数据稀缺问题,这些数据已被用于微调开放模型,使其在与验证相关的任务上达到或超过Claude Opus 4.5的性能。该项目还引入了最大熵原理来生成多样化的程序,并发布了…

  3. COMMENTARY · CL_113698 ·

    新的评估框架通过改变实现方式而非仅仅是AI模型来测试软件安全

    这篇博文提出了一个多维度评估框架,用于评估软件的安全性,特别是在AI辅助开发的环境下。作者建议,与其仅仅改变被测试的AI模型,不如改变其他组件,例如不同的编程语言、形式化验证工具或容器运行时。这种方法旨在通过保持AI能力不变,并针对不同的实现和环境进行测试,从而更全面地理解软件的健壮性。作者举例说明了容器安全评估和压缩算法的形式化验证,认为这些是迈向多维度评估的步骤。

  4. TOOL · CL_70372 ·

    新基准揭示AI在验证代码生成方面存在困难

    一个名为AlgoVeri的新基准已被开发出来,用于评估AI模型在为经典算法生成形式化验证代码方面的性能。该基准在三种语言:Dafny、Verus和Lean中测试模型,揭示了显著的能力差距。虽然Gemini-3 Flash在Dafny中表现出中等成功,但在Verus和Lean中的表现却显著下降,这凸显了在内存约束和显式证明构建方面的挑战。

  5. TOOL · CL_61984 ·

    AI使用证明检查器生成形式化验证代码

    研究人员开发了一种名为归纳演绎综合(Inductive Deductive Synthesis)的新AI方法,该方法在其实现循环中使用了证明检查器。这种方法类似于思维链(chain-of-thought),但具有形式化验证的中间状态,使AI能够生成形式化验证的系统。该系统以规范作为输入,并生成经过验证的实现原型,并计划与其他证明助手(如用于Rust输出的Verus)集成。