一篇新发表在arXiv上的论文认为,目前用于认证AI系统的、侧重于预测准确性和置信度的方法不足以确保可信度。研究人员Nataliya Shakhovska教授和她的同事们引入了“能力包络”的概念,该概念结合了预测和解释认证。该框架旨在检测仅凭预测端证书无法看到的故障模式,除了模型的输出来访问其决策过程。 AI
影响 提出了一个新的AI可信度框架,可能会提高模型在关键应用中的可靠性。
排序理由 发表在arXiv上的学术论文,详细介绍了新的AI可信度框架。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →