实体
UltraChat
UltraChat
PulseAugur coverage of UltraChat — every cluster mentioning UltraChat across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新方法优化LLM微调的效率和数据质量 · 跟踪2个来源
两篇研究论文介绍了优化大型语言模型(LLM)监督微调(SFT)的新颖方法。第一种方法“在线动态批处理”(ODB)通过将批处理形成移至准确可观察点来解决训练期间可变样本处理成本的挑战,将吞吐量提高了4.43倍。第二种方法“效用-多样性感知在线批处理选择”(UDS)侧重于在SFT期间选择有价值且多样化的数据样本,以防止过拟合和偏差放大,其性能优于现有方法并减少了训练时间。
-
新框架EiCAP探测和提高大型语言模型的情商
研究人员开发了EiCAP,一个用于评估和增强大型语言模型(LLMs)情商(EI)的新框架。该框架包括EiCAP-Bench,一个包含3174个探针的评估套件,以及EiCAP-SFT,一个用于监督微调的大型语料库。实验表明,标准的对话微调并不能提高情商,但针对Qwen-2.5-7B-Base进行基于情商的LoRA训练,可以显著提高所有情商子类别的性能。