研究人员开发了一种新的机器学习模型审计协议,旨在防止提供商操纵评估过程。该协议利用私有信息检索(PIR)机制,允许审计员查询模型,而提供商不知道将审计哪些具体数据点。该方法被设计为高效、开销最小,并且不需要更改模型或其推理管道。理论保证和实验结果表明,通过迫使提供商伪造更多响应来隐藏不公平性,这种方法显著提高了操纵的可检测性。 AI
影响 通过使操纵更易于检测,增强了机器学习模型评估的可信度。
排序理由 该集群包含一篇详细介绍机器学习模型新审计协议的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- arXivLabs
- CatalyzeX Code Finder for Papers
- CORE Recommender
- DagsHub
- Gotit.pub
- Hugging Face
- IArxiv Recommender
- Influence Flower
- private information retrieval
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →