研究人员开发了一个名为SalesLLM的新基准,用于评估大型语言模型(LLM)的真实销售能力。该基准提供中文和英文版本,源自真实销售对话,并包含可控的难度和角色设定。自动评估流程结合了用于销售进展的LLM裁判和用于购买意图的BERT分类器。该基准还包含一个训练好的用户模型CustomerLM,与GPT-4o等模型相比,它显著减少了角色反转。 AI
影响 该基准有望推动在销售和客户互动领域更有效的LLM的发展。
排序理由 该集群描述了一篇介绍用于评估LLM能力的新型基准的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- Bert
- CustomerLM
- Direct Preference Optimization
- GPT-4o
- Hugging Face
- SalesLLM
- supervised fine-tuning
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →