研究人员推出了 AppraiSal 基准,这是一个包含 996 场情绪支持对话的数据集,并标注了人类心理状态和重要的认知评估维度。该基准旨在帮助大型语言模型 (LLM) 更好地推断特定情境下的评估维度,这对于在情绪支持任务中修改认知评估至关重要。为了解决这个问题,一个基于贝叶斯逆向规划的新框架 PRISM 被开发出来,该框架在各种模型规模下都展示了 LLM 识别这些重要维度的能力的提升。 AI
影响 增强了 LLM 在理解和回应对话中情感细微差别方面的能力。
排序理由 该集群描述了一篇介绍 LLM 基准和框架的新学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- Bayesian inverse planning
- CatalyzeX
- DagsHub
- Gotit.pub
- Hugging Face
- Large Language Models
- PRISM
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →