研究人员开发了一个用于指令微调大型语言模型(LLMs)的统一数据集,该数据集专门关注道德场景。该数据集通过合并现有的道德价值观数据集并将其转换为指令-响应格式来创建。初步研究结果表明,在通用任务数据集之外纳入此道德价值观数据集,有助于在提高面向价值观的任务性能的同时,保持在通用任务上的性能,其中混合比例是关键因素。 AI
影响 该数据集可以改善大型语言模型与人类价值观的一致性,使其在各种应用中更加可靠和合乎道德。
排序理由 关于LLM指令微调新数据集的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- A Unified Moral-Value Dataset for Instruction Tuning
- general task datasets
- Hugging Face
- large-language models
- moral scenarios
- moral-value datasets
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →