研究人员在Vision Transformer与小型CNN之间的知识蒸馏中发现了一个显著的几何瓶颈。标准的余弦蒸馏会导致学习到的表示坍缩到低维空间,而与CNN的参数数量无关。虽然一个辅助的InfoNCE目标可以扩展这种维度,但它却会使下游准确率降低15-18个百分点。然而,一种标签感知的监督对比蒸馏方法通过在保持或提高准确率的同时增加维度,显示出潜力,这表明维度扩展的效用取决于目标是否为标签感知。 AI
影响 强调了在跨模态蒸馏中,标签感知目标对于有效表示学习的重要性。
排序理由 学术论文,详细介绍了AI模型蒸馏技术的新发现。[lever_c_demoted from research: ic=1 ai=1.0]
- CIFAR-10
- CIFAR-100
- CLIP ViT-B/32
- CNNs
- InfoNCE
- Kabir Thayani
- Supervised Contrastive distillation
- Vision Transformers
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →