研究人员开发了一种新颖的方法来对抗语言模型迭代微调中的“模型崩溃”现象,即输出多样性随时间减少。这种基于信息论并利用 Kontoyiannis 熵率估计器的新方法,不需要访问模型对数概率或真实人类数据。在 Llama-3.1-8B 的实验中,这种基于文本的过滤技术显著提高了文本多样性指标,其性能优于依赖模型访问的既有方法。 AI
影响 为改进 LLM 微调中使用的合成数据的多样性和质量提供了一种新的、与模型无关的方法。
排序理由 学术论文,详细介绍了一种缓解特定人工智能训练问题的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →