一篇新研究论文介绍了一种名为 THEMIS 的工作流,旨在使使用大型语言模型修复软件错误的流程更加透明和可审计。该系统将需求修复的产物外部化,创建语义解释和运行时需求-代码图。对 300 个 SWE-bench Lite 案例的回顾性审计表明,THEMIS 提供了全面的开发者理由和审计记录,便于跨阶段检查和分析修复决策。 AI
影响 增强了 LLM 驱动的软件修复的透明度和可审计性,可能提高 AI 生成代码修复的可靠性和信任度。
排序理由 该集群包含一篇详细介绍新研究方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →