研究人员开发了一种名为“认证腐败预算”的新方法,以确保AI模型排行榜的完整性。该技术提供了任何时候都有效的排名声明,即使攻击者试图通过投票操纵或选择性披露私人模型变体等方法来操纵结果。认证腐败预算在记录达到一定数量后计算得出,保证声明的正确性或大量记录被损坏,能够抵御能够观察认证过程的自适应攻击者。 AI
影响 增强了对AI模型评估的信任,这对于开发和部署决策至关重要。
排序理由 该集群包含一篇详细介绍AI模型评估新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →