《Communications of the ACM》上的一篇最新文章提出使用大型语言模型 (LLM) 自动修复软件异常,使程序能够继续运行。研究表明,这种 LLM 驱动的自愈方法可以使程序在 73% 的时间内保持运行,并且在产生正确行为方面的成功率为 39%。然而,该研究还指出,令人担忧的是,有 34% 的情况 LLM 会引入未定义行为,这表明需要进一步建立信任机制,例如行为允许列表。 AI
影响 引发了关于 LLM 在关键软件开发任务中的实际应用和可靠性的疑问。
排序理由 该条目是一篇评论文章,批评发表在杂志上的研究,而不是主要公告。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →