arXiv 上 Amir M. Ebrahimi 的一篇新论文提出了数据仓库工程在大型语言模型后训练方面的工业视角。该研究将此过程定义为“遗留系统维护”,即在固定资源限制下对已部署的模型进行改进,同时不引起回归。论文强调了三个关键挑战:零和混合设计、以产出率为主要指标以及在不确定性下的集成。所提出的方法侧重于产出率工程,在 Codeforces 和 LiveCodeBench v6 等编码基准测试中表现出显著的改进,同时保持了在数学数据集上的性能。 AI
影响 提出了一种新的 LLM 维护工程学科,有望提高已部署模型的效率和稳定性。
排序理由 关于 LLM 后训练技术的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- Amir M. Ebrahimi
- arXiv
- Codeforces
- Dataware Engineering
- Hugging Face
- LiveCodeBench v6
- LLM Post-Training as Brownfield Maintenance
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →