一篇新的arXiv论文探讨了基础模型不同的预训练策略如何影响其在超广角视网膜成像任务上的迁移效果。研究人员比较了使用监督学习、掩码自编码器(MAE)和自蒸馏目标训练的Vision Transformer编码器。结果表明,监督学习和自蒸馏方法的表现优于MAE,其中大规模DINOv3模型在诊断糖尿病视网膜病变方面表现最佳。研究还发现,预训练策略会影响模型如何聚合来自不同图像块的证据,并且部分微调可以提高MAE的性能。 AI
影响 研究了不同AI模型预训练如何影响其在专业医疗成像任务中的性能,可能为未来医疗应用的模型开发提供指导。
排序理由 该集群包含一篇详细介绍模型迁移性实验结果的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- DINOv1
- DINOv3
- Mae
- Masked Autoencoder
- Mingya Alexa Gong
- vision transformer
- Vision Transformer Base
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →