一篇新发布的arXiv论文《C指数的幻觉:已发表生存模型中的无校准歧视》对仅以C指数衡量的生存分析模型区分能力进行评估的常见做法提出了质疑。研究表明,由于该指标忽略了模型校准和时间依赖性准确性,因此可能具有误导性。该研究重现了来自不同领域的三个已发表的生存机器学习模型,发现一个区分能力与已发表模型几乎相同的模型在正式校准测试中失败了。该论文还强调,将删失误解为非信息性可能导致金融模型风险估计出现重大偏差。 AI
影响 强调了常见机器学习模型评估指标的潜在缺陷,敦促谨慎解读区分度得分。
排序理由 发表在arXiv上的学术论文,讨论了机器学习模型的评估方法。[lever_c_demoted from research: ic=1 ai=1.0]
- churn model
- C-index
- Competing Risk of Death and ESRD in Incident CKD Patients
- hard disk drive failure
- Holm-corrected family-wise error rate
- International Conference on Machine Learning
- loan prepayment
- peer-to-peer credit default
- Survival models for heterogeneous populations derived from stable distributions
- User Disengagement-Oriented Target Enforcement for Multi-Tenant Database Systems
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →