研究人员探讨了使用零知识证明进行人工智能监督的可能性,旨在验证人工智能输出而不泄露底层机密数据。他们发现,在随机预言机模型中,即使延长计算时间,也无法实现对所有预言机辅助计算的通用零知识证明。然而,通过证明如果预言机对每个答案进行签名,零知识验证就可以在假设存在抗碰撞哈希函数的情况下,通过高效的证明者和验证者来实现,从而取得了一个积极的结果。 AI
影响 这项研究强调了在实现人工智能输出的私有验证方面可能存在的局限性,表明可能需要新的密码学方法来实现安全的人工智能监督。
排序理由 该集群包含一篇详细介绍人工智能安全和验证新研究发现的学术论文。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →