PulseAugur
实时 15:27:06
English(EN) LLMs Have Learned All Open Code on GitHub - But Missed the Most Important Part.

LLM 需要提交历史记录,而不仅仅是最终代码,才能成为真正的工程师

目前在 GitHub 代码上训练的大型语言模型是优秀的模仿者,但缺乏真正的工程理解,因为它们只看到最终的代码版本。作者建议在项目的完整提交历史记录(包括提交消息)上训练 LLM,以揭示代码演变背后的决策过程。这种方法可以使模型学会架构推理、重构技能以及代码更改背后的“原因”,将它们从单纯的模仿者转变为真正的工程师。 AI

影响 在提交历史记录上训练 LLM 可能有助于培养更具能力的 AI 工程师,并提升其架构决策能力。

排序理由 该条目是一篇讨论 LLM 训练方法的观点文章。

在 dev.to — LLM tag 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

LLM 需要提交历史记录,而不仅仅是最终代码,才能成为真正的工程师

报道来源 [1]

  1. dev.to — LLM tag TIER_1 English(EN) · Kostya27 ·

    LLMs Have Learned All Open Code on GitHub - But Missed the Most Important Part.

    <p>Or why AI coders are just imitators, not real engineers.</p> <p>We are used to thinking that modern large language models (LLMs) know everything about programming. They are trained on billions of lines of code from open GitHub repositories. They can write even a big app from s…