研究人员开发了一个新颖的框架,用于提高大型语言模型(LLMs)在心理健康支持方面的治疗质量。该方法将治疗性响应生成视为一个决策优化问题,利用多维度、符合人类期望的评估。该系统包括 TheraJudge,一个基于人类偏好训练的开源评估器,它在安全性和共情等关键维度上与临床医生的评分高度一致。然后,TheraAgent 利用 TheraJudge 的评估来优化响应,从而显著提高了治疗质量,并实现了高比例的不安全输出恢复率。 AI
影响 这项研究展示了一种在心理健康支持等敏感应用中提高大型语言模型对齐和安全性的方法。
排序理由 该集群包含一篇学术论文,详细介绍了用于提高大型语言模型在特定领域性能的新框架和系统。
在 arXiv cs.MA (Multiagent) 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →