Waterbirds
PulseAugur coverage of Waterbirds — every cluster mentioning Waterbirds across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
SpurCon框架提升医学影像AI的可靠性
研究人员开发了SpurCon,一个旨在提高医学影像深度神经网络可靠性和鲁棒性的新框架。该方法解决了模型利用虚假相关性(例如与病理共现的伪影)的问题,这会损害临床信任,尤其是在小型或不平衡的数据集中。SpurCon利用加权监督对比损失公式WtSupCon和一种快速少样本程序来估计虚假标签,而无需广泛的网络训练。通过根据病理和元数据组合分配样本特定权重,SpurCon增强了表示几何,从而在Waterbirds、CheXpert和ISIC …
-
新方法揭示视觉模型中的空间捷径模式
研究人员开发了一种新方法,通过将每张图像的贡献图分组为重复的空间模式,来识别和表征视觉模型中的捷径学习。该方法利用 K-means 和非负矩阵分解,揭示了在各种数据集和模型架构(如 ResNet 和 ViT)中,捷径和任务贡献的共享和不同空间模式。发现的捷径组能够针对性地检查错误率较高的图像子集,而抑制捷径贡献的干预措施会显著降低模型性能,这表明结合抑制和放大方法可以减少性能差异。
-
新方法在训练后识别AI模型中的虚假相关性
研究人员开发了一种新方法来识别机器学习模型训练数据中的虚假相关性。这种名为“收敛时的扰动敏感性”的技术,在训练完成后分析模型的行为。它识别出那些由共享规则(与虚假相关性一致)分类的样本,以及那些对输入微小变化更敏感(符合个体配置)的样本。该方法每个训练样本仅需两次前向传播,且无需分组标注,显著提高了Waterbirds等数据集上的最差分组准确率。
-
新框架解决深度学习模型中的虚假相关性 · 已追踪2个来源
研究人员开发了一个新颖的两阶段框架,通过解决虚假相关性来提高深度神经网络在分布变化下的鲁棒性。该方法首先使用具有扩散模型的生成干预来创建前景对象的上下文偏移变体,在保持身份的同时改变背景。然后,一种新的跨变体自监督学习技术通过配对不同背景下的同一对象的变体来对齐以对象为中心的表示,从而抑制特定于背景的线索。该方法在Waterbirds、MetaShift和NICO++等基准测试中取得了最先进的性能。
-
新的关联恢复测试评估人工智能遗忘的有效性
研究人员引入了关联恢复测试(ART),这是一种新的诊断工具,旨在评估人工智能模型中关联遗忘的有效性。该方法专门评估在遗忘尝试后,可能导致有偏见或不正确关联的捷径是否可以被原始分类器在功能上恢复。ART在多个数据集上进行了测试,包括Waterbirds、CelebA和SpuCoDogs,证明与现有的输出级或表示探测评估相比,它提供了对捷径缓解的不同视角。
-
新方法在不重新训练的情况下识别和缓解视觉模型中的偏见
研究人员开发了一种新颖的后验方法,可以在不要求额外标签或重新训练的情况下,识别和缓解已冻结的视觉模型中的偏见。该技术利用概念分解上的梯度探针,根据虚假概念与错误分类示例的交互来对其进行排名。这种方法成功地识别了 Colored MNIST 和 Waterbirds 等数据集中的已知虚假线索,并在 CelebA 中发现了与决策相关的方向,从而显著提高了最差群体准确性。
-
新的CAML框架提升机器学习模型对抗虚假关联的鲁棒性
研究人员开发了一个名为累积主动元学习(CAML)的新型主动学习框架,以提高机器学习模型对抗虚假关联的鲁棒性。CAML将每个主动学习轮次视为一个元学习任务,利用查询到的样本来调整模型的归纳偏倚,而不仅仅是更新其似然性。这种累积方法捕捉了学习轮次之间的顺序依赖性,从而在各种基准测试中显著提高了少数群体的准确性。