Google DeepMind 正在试点一种新颖的AI基准测试方法,旨在增强信任并防止篡改。该方法通过 Confidential Space 使用加密保护,确保谷歌无法查看测试问题,评估者也无法访问模型权重。该倡议与新加坡AI安全研究所合作进行,使用了 Gemini Flash Lite 模型,并可能为安全可靠的AI评估建立新的行业标准。 AI
影响 该倡议可能为安全且防篡改的AI评估建立新标准,从而提高对基准测试结果的信任度。
排序理由 该项目描述了一个新的AI基准测试方法的试点项目,属于AI安全领域的研究与开发。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →