研究人员开发了针对德语和挪威语临床自然语言处理的新领域特定语言模型。基于RoBERTa的德语ChristBERT模型在一个13.5GB的语料库上进行了训练,在医学任务上的表现优于现有模型。挪威语KliniskVestBERT套件使用BERT编码器,在Helse Vest的去标识化临床文本上进行了预训练,相比基线模型有了显著改进。这两个项目都强调了专业化预训练在临床语言理解方面的优势,并公开发布了它们的模型。 AI
影响 像ChristBERT和KliniskVestBERT这样的领域特定模型可以显著提高医疗应用中临床文本处理的准确性和效率。
排序理由 该集群包含两篇学术论文,详细介绍了为临床自然语言处理创建和评估领域特定语言模型的过程。
- BERT
- KliniskVestBERT
- ModernBERT
- Nb-BERT-large
- NorBERT3-large
- Norwegian
- Helse Vest ICT
- ChristBERT
- RoBERTa
AI 生成摘要 · Google Gemini · 来自 4 个来源。 我们如何撰写摘要 →