一篇新发表在arXiv上的论文强调了异常检测算法排名存在显著的不稳定性。研究人员发现,常见的基准测试实践,如数据集选择和超参数选择,会极大地改变算法排名,导致比较结果不可靠。该研究表明,当前的基准测试往往缺乏可复现和可靠评估在这个关键机器学习领域所需的多元化和规模。 AI
影响 强调了评估AI安全系统中的关键问题,可能影响可靠异常检测的开发和部署。
排序理由 该集群包含一篇在arXiv上发表的研究论文,讨论了机器学习的方法论和发现。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX Code Finder for Papers
- CORE Recommender
- DagsHub
- Gotit.pub
- Hugging Face
- IArxiv Recommender
- Influence Flower
- OddBench
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →