研究人员推出了一种新颖的两阶段大型语言模型参数高效微调方法LoCA。该技术旨在通过一次校准过程替换重复的端到端反向传播来降低计算负担。LoCA通过拟合每个Transformer块的低秩映射来纠正预测错误,然后使用这些映射进行前向传播微调。在Qwen2.5模型上的评估表明,与LoRA相比,LoCA提供了更低的交叉熵,并显著降低了GPU峰值内存、CPU内存和每次迭代的时间。 AI
影响 提供了一种更有效的LLM适应方法,可能降低微调的门槛。
排序理由 详细介绍LLM微调新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →