OpenAI 推出了私有安全处理(Private Safety Processing)系统,这是一个旨在跨多次用户交互检测有害模式的新系统,而无需保留对话数据。这解决了单次交互安全检查的局限性,这种检查不足以识别协调攻击或持续性不匹配等复杂的滥用模式。该系统允许内容保留在客户控制的基础设施上,或使用客户持有的密钥进行加密,OpenAI 只接收滥用类别和严重程度的信号,而不是内容本身。这种方法与 Anthropic 的模型形成对比,Anthropic 的模型会保留数据 30 天以观察模式,这凸显了企业在选择前沿 AI 模型时的一个关键权衡。 AI
影响 该系统通过能够检测复杂的多轮滥用模式,解决了 AI 安全中的一个关键差距,有可能加速企业采用先进的 AI 模型。
排序理由 OpenAI 宣布为其前沿模型推出新的安全系统。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →