一项新的研究论文评估了包括 OpenAI 的 GPT、Google 的 Gemini 和 Anthropic 的 Claude 在内的大型语言模型,在协助对患有边缘型人格障碍的患者进行的临床访谈进行定性分析方面的能力。研究发现,虽然人工智能模型在与人类的解读方面表现出可变的重叠性,但它们也识别出了人类研究人员忽略的主题,可能减轻了人为偏见。值得注意的是,在盲评中,Gemini 2.5 Pro 在内容效度和语义风格方面的表现与人类临床专家无法区分。 AI
影响 展示了大型语言模型在复杂定性分析方面提供帮助的潜力,其中 Gemini 2.5 Pro 在特定临床环境中表现出达到人类水平的性能。
排序理由 学术论文,评估大型语言模型在特定任务上的能力。[lever_c_demoted from research: ic=1 ai=1.0]
- Anthropic
- borderline personality disorder
- Claude
- Gemini
- Gemini 2.5 Pro
- generative pre-trained transformer
- OpenAI
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →