PulseAugur
实时 09:33:48
English(EN) Revocable Learned State via Process Sidecars

新的“进程 Sidecar”方法允许精确撤销语言模型的记忆

研究人员推出了一种名为“进程 Sidecar”的新颖方法,用于在安全训练后撤销语言模型中的学习信息。该技术旨在精确删除特定记忆,而不会像简单的减法方法那样负面影响模型的安全能力。该方法在新的 arXiv 论文中进行了详细介绍,使用了双系数编辑家族,并与标准任务算术相比,在多个模型上显示出改进的拒绝关闭率。 AI

影响 这项研究可能实现对 LLM 记忆和安全功能更精细的控制,从而可能带来更具适应性和更安全的 AI 系统。

排序理由 该集群包含一篇详细介绍修改语言模型新方法的学术论文。

在 arXiv cs.CL 阅读 →

AI 生成摘要 · Google Gemini · 来自 17 个来源。 我们如何撰写摘要 →

新的“进程 Sidecar”方法允许精确撤销语言模型的记忆

报道来源 [17]

  1. arXiv cs.CL TIER_1 English(EN) · John Sweeney ·

    通过进程 Sidecar 实现可撤销的学习状态

    arXiv:2606.30788v1 Announce Type: cross Abstract: Language models are often adapted in stages: a public skill phase, a private memory phase, and a later safety phase that learns to refuse outputs tied to the remembered entities. Revoking the memory after the safety phase is not t…

  2. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    8/ 机会主义专家激活:批感知专家路由,无需重新训练即可实现更快解码 (OEA)

    8/ Opportunistic Expert Activation: Batch-Aware Expert Routing for Faster Decode Without Retraining (OEA) Paper: https://t.co/dw33plIoxW

  3. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    6/ 当强化学习遇上自适应推测训练:一个统一的训练-服务系统 (Aurora)

    6/ When RL Meets Adaptive Speculative Training: A Unified Training-Serving System (Aurora) Paper: https://t.co/fvLuHrqDbX

  4. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    7/ 联合尤利西斯:通过头部分块实现内存高效的上下文并行

    7/ Untied Ulysses: Memory-Efficient Context Parallelism via Headwise Chunking Paper: https://t.co/LgGqu8vl97

  5. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    5/ V1:统一生成与自验证以实现并行推理器

    5/ V1: Unifying Generation and Self-Verification for Parallel Reasoners Paper: https://t.co/X1zUsS7gY8

  6. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    2/ ThunderAgent:一个简单、快速且程序感知的代理推理系统

    2/ ThunderAgent: A Simple, Fast and Program-Aware Agentic Inference System Paper: https://t.co/7I1Yf5s8B8

  7. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    3/ 测试时学习发现(TTT-Discover)

    3/ Learning to Discover at Test Time (TTT-Discover) Paper: https://t.co/pKeadv4DHl

  8. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    4/ 逃离验证器:通过演示学习推理 (RARO)

    4/ Escaping the Verifier: Learning to Reason via Demonstrations (RARO) Paper: https://t.co/gQZCEav8Nb

  9. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    1/ DSGym:用于评估和训练数据科学代理的整体框架

    1/ DSGym: A Holistic Framework for Evaluating and Training Data Science Agents Paper: https://t.co/jV4uMB1g48

  10. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    8/ 机会主义专家激活:批感知专家路由,无需重新训练即可实现更快解码 (OEA)

    8/ Opportunistic Expert Activation: Batch-Aware Expert Routing for Faster Decode Without Retraining (OEA) https://t.co/dw33plIoxW

  11. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    5/ V1:统一生成与自验证以实现并行推理器

    5/ V1: Unifying Generation and Self-Verification for Parallel Reasoners https://t.co/X1zUsS7gY8

  12. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    6/ 当强化学习遇上自适应推测训练:统一的训练-服务系统 (Aurora)

    6/ When RL Meets Adaptive Speculative Training: A Unified Training-Serving System (Aurora) https://t.co/fvLuHrqDbX

  13. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    7/ 散开的尤利西斯:通过头部分块实现内存高效的上下文并行

    7/ Untied Ulysses: Memory-Efficient Context Parallelism via Headwise Chunking https://t.co/LgGqu8vl97

  14. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    2/ ThunderAgent:一个简单、快速且程序感知的代理推理系统

    2/ ThunderAgent: A Simple, Fast and Program-Aware Agentic Inference System https://t.co/7I1Yf5s8B8

  15. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    3/ 测试时学习发现 (TTT-Discover)

    3/ Learning to Discover at Test Time (TTT-Discover) https://t.co/pKeadv4DHl

  16. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    4/ 逃离验证器:通过演示学习推理 (RARO)

    4/ Escaping the Verifier: Learning to Reason via Demonstrations (RARO) https://t.co/gQZCEav8Nb

  17. X — Together (inference / OSS) TIER_1 English(EN) · togethercompute ·

    1/ DSGym:用于评估和训练数据科学代理的整体框架

    1/ DSGym: A Holistic Framework for Evaluating and Training Data Science Agents https://t.co/jV4uMB1g48