PulseAugur
实时 10:28:40

新的LEMUR框架可从推理MLRM中移除敏感数据

研究人员开发了LEMUR,一个旨在从多模态大型推理模型(MLRM)中移除敏感信息的新颖框架。该方法在推理时运行,无需重新训练模型。LEMUR识别了训练后强化学习(RL)引入的隐私漏洞,这些漏洞可能导致敏感事实在模型的推理过程中泄露,即使它们不在最终答案中。通过利用RL引起的探索特有的令牌级熵签名,LEMUR重定向推理过程以净化这种泄露,同时保持模型的整体效用和流畅性。 AI

影响 引入了一种新颖的MLRM推理时移除技术,解决了推理过程中的隐私风险,并可能提高模型安全性。

排序理由 详细介绍从ML模型中移除敏感信息新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CL 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新的LEMUR框架可从推理MLRM中移除敏感数据

报道来源 [1]

  1. arXiv cs.CL TIER_1 English(EN) · Xinhao Zhong, Yuxia Qiao, Junhao Li, Hao Fang, Yi Sun, Bin Chen ·

    LEMUR:通过视觉锚定推理重定向实现潜在熵感知多模态非学习

    arXiv:2608.11691v1 Announce Type: cross Abstract: Reinforcement-learning (RL) post-training equips multimodal large reasoning models (MLRMs) with exploratory chains of thought (CoT), substantially improving visual reasoning. However, we find that this capability introduces a dist…