研究人员开发并评估了用于评估阿拉伯语危机求助电话中自杀风险的大型语言模型,并将其表现与英语翻译进行了比较。该研究使用了黎巴嫩国家情感支持和预防自杀生命线去标识化的通话记录,通过在现场处理音频来确保数据隐私。阿拉伯语和英语模型都经过了微调和测试,表现最佳的阿拉伯语模型在高风险电话的宏观F1值为81.19,ROC-AUC为90.61,而表现最佳的英语模型分别为85.00和92.59。研究结果表明,可以从去标识化的阿拉伯语通话记录中有效分类自杀风险,支持这些模型作为面向接线员的工具的潜力。 AI
影响 展示了大型语言模型在心理健康支持等专业、隐私敏感领域的应用能力,有望提高危机干预效率。
排序理由 学术论文,详细介绍了大型语言模型在特定领域的创新应用及性能指标。[lever_c_demoted from research: ic=1 ai=1.0]
- Arabic
- Columbia Suicide Severity Rating Scale
- English
- large-language models
- Lebanon
- Levantine Arabic
- National Lifeline for Emotional Support and Suicide Prevention
- Transformer encoder
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →