实体
CLIP-B/32
CLIP-B/32
PulseAugur coverage of CLIP-B/32 — every cluster mentioning CLIP-B/32 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
使用面部空想性错觉诊断探测视觉模型的偏见
研究人员开发了一个新的诊断框架,利用面部空想性错觉来评估视觉模型在面对模糊视觉输入时的行为。该研究分析了包括视觉-语言模型(VLMs)、纯视觉分类器和目标检测器在内的六个模型,以了解它们的决策过程。研究结果表明,LLaVA-1.5-7B等VLMs倾向于表现出语义过度激活,经常将非人脸图案误解为人脸,特别是带有负面情绪的图案。相比之下,ViT等纯视觉分类器在没有明显偏见的情况下表现出不确定性,而目标检测器则通过保守的先验知识保持低偏见。
-
EASE框架通过解决纠缠问题实现联邦多模态遗忘
研究人员开发了EASE,一种用于联邦多模态遗忘的新框架,该框架解决了不同数据模态和客户端更新之间纠缠知识的挑战。该方法识别导致遗忘信息持续存在的三个关键“锚点”,并提出切断这些连接的技术。EASE利用双边位移处理跨模态通道,并使用余弦-正弦分解来分离遗忘专属更新方向,旨在有效删除特定数据同时保留模型的通用能力。