一篇新发表在arXiv上的研究论文,调查了评估设计对专家分配和自动生成的医学主题词(MeSH)在用作分类任务特征时的性能差距的影响。该研究在Cohen药物类别识别基准上,比较了词袋逻辑回归模型和领域特定语言模型BiomedBERT。研究结果表明,专家分配和自动分配MeSH之间的差距会因评估方法(如语料库大小和交叉验证折叠)而显著不同。研究还指出,像BiomedBERT这样的Transformer模型在处理附加的MeSH术语时可能面临令牌限制,这可能会影响其性能。 AI
排序理由 学术论文发表在arXiv上,详细介绍了实验结果和分析。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- attention deficit hyperactivity disorder
- Cohen
- Domain-Specific Language Model Pretraining for Biomedical Natural Language Processing
- Hugging Face
- Medical Subject Headings
- Opioids
- statin
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →