实体
SigLIPv2
SigLIPv2
PulseAugur coverage of SigLIPv2 — every cluster mentioning SigLIPv2 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
SnapViT 可在无需重新训练的情况下实现弹性 Vision Transformer
研究人员开发了 SnapViT,这是一种创建弹性 Vision Transformer (ViTs) 的新颖方法,该方法可以在不重新训练的情况下适应各种计算预算。这种预训练后的结构化剪枝技术有效地结合了梯度信息和跨网络结构相关性,并通过进化算法进行近似。在多个预训练模型上的实验表明,SnapViT 在不同稀疏度下优于现有方法,并且可以在单个 A100 GPU 上在五分钟内生成可调模型。
-
Franca:开源视觉模型性能媲美闭源模型
研究人员推出了 Franca,一个开源视觉基础模型,旨在匹配或超越 DINOv2 和 CLIP 等闭源模型的性能。该模型采用新颖的嵌套俄罗斯套娃表示法进行参数高效的多头聚类,逐步将特征细化为更精细的聚类,而无需增加模型大小。Franca 还采用位置解耦策略来改进语义内容编码,从而在下游基准测试中获得更好的性能,并促进基础模型开发的透明度和可复现性。