研究人员推出了一种新颖的框架C-Score,旨在评估半监督学习(SSL)模型的鲁棒性,特别是在面对被分布外(OOD)样本污染的未标记数据时。传统的SSL方法通常假设数据是干净的,但C-Score解决了“隐藏崩溃”问题,即尽管内部性能下降,模型性能指标可能仍显示稳定。该框架评估了预测、特征表示和优化空间中的训练行为,利用了PLE、CCI、Sem-Drift和Grad-Align等指标。在CIFAR-10和CIFAR-100数据集上的实验表明,C-Score能有效揭示标准准确性指标未能检测到的性能下降,突显了在现实世界、开放世界场景中可靠评估SSL的内部诊断信号的必要性。 AI
影响 为在现实条件下评估半监督学习模型的鲁棒性提供了一种更可靠的方法。
排序理由 该集群包含一篇详细介绍机器学习模型新评估框架的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →