PulseAugur
实时 04:41:18
English(EN) OpenAI wants to watch across conversations without keeping them

OpenAI 预览私有安全处理功能,可在不保留数据的情况下跨对话检测滥用行为

OpenAI 推出了私有安全处理(Private Safety Processing)系统,这是一个旨在跨多次用户交互检测有害模式的新系统,而无需保留对话数据。这解决了单次交互安全检查的局限性,这种检查不足以识别协调攻击或持续性不匹配等复杂的滥用模式。该系统允许内容保留在客户控制的基础设施上,或使用客户持有的密钥进行加密,OpenAI 只接收滥用类别和严重程度的信号,而不是内容本身。这种方法与 Anthropic 的模型形成对比,Anthropic 的模型会保留数据 30 天以观察模式,这凸显了企业在选择前沿 AI 模型时的一个关键权衡。 AI

影响 该系统通过能够检测复杂的多轮滥用模式,解决了 AI 安全中的一个关键差距,有可能加速企业采用先进的 AI 模型。

排序理由 OpenAI 宣布为其前沿模型推出新的安全系统。[lever_c_demoted from frontier_release: ic=1 ai=1.0]

在 dev.to — Anthropic tag 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

OpenAI 预览私有安全处理功能,可在不保留数据的情况下跨对话检测滥用行为

报道来源 [1]

  1. dev.to — Anthropic tag TIER_1 English(EN) · Breach Protocol ·

    OpenAI 希望在不保留对话的情况下进行跨对话监控

    <p>OpenAI announced on August 19, 2026 that it is previewing a system called Private Safety Processing, designed to catch abuse patterns that only become visible across multiple interactions while preserving its zero-data-retention promise to enterprise customers. Content stays e…