清华大学的研究人员开源了 VeriLoop Coder-E1,这是一个用于可验证递归自改进以进行代码修复的模型。VeriLoop Coder-E1 基于 Qwen3.6-27B 架构构建,采用“基于证据的螺旋式”方法来增强其代码修复能力。该模型在 SWE-bench Verified、SWE-bench Pro、Terminal-Bench 2.0 和 DeepSWE 等多个基准测试中表现强劲,尤其是在采用窄域 PEFT 和 Self-Harness 技术时。 AI
影响 此次发布为自动化代码修复和自改进提供了一个新工具,有望提高软件开发效率。
排序理由 具有基准测试结果的代码修复模型开源发布。[lever_c_demoted from research: ic=1 ai=1.0]
- Evidence-Governed Spiral
- Qwen3.6-27B
- SWE-bench Pro
- SWE-bench Verified
- Terminal-Bench 2.0
- Tsinghua University
- VeriLoop Coder-E1
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →