研究人员开发了一种名为词级概率MIA(WPMIA)的新方法,即使只能访问文本续写,也能检测文本是否属于大型语言模型的训练数据。该技术通过蒙特卡洛采样和核平滑来估计词级生成概率,然后将这些概率聚合为序列级似然估计器。WPMIA在GPT-5 Chat、Gemini 2.5-Flash和Claude 4.5 Haiku等专有模型上进行了测试,在5%的假阳性率(FPR)下实现了42.0%的真阳性率(TPR),证明了其在严格的黑盒隐私审计中的有效性。 AI
影响 这项新的隐私审计技术可能会迫使LLM开发者加强专有模型的数据保护措施。
排序理由 该集群包含一篇详细介绍LLM隐私审计新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →