实体
OpenBookQA
OpenBookQA
PulseAugur coverage of OpenBookQA — every cluster mentioning OpenBookQA across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新的SPARD框架防御LLM免受有害微调攻击
研究人员开发了一个名为SPARD的新防御框架,以对抗大型语言模型上的有害微调攻击。这些攻击旨在移除安全对齐并诱导不安全行为。SPARD将安全投影交替优化与相关性-多样性感知数据选择相结合,使用一种名为SPAG的方法,该方法在效用更新和具有安全数据的显式安全投影之间交替进行。实验表明,SPARD在防止攻击的同时保持任务准确性方面,显著优于现有的防御方法。
-
新技术循环 Transformer 层以提升模型性能
研究人员开发了一种名为训练免费循环 Transformer 的新颖技术,该技术可以在不进行任何额外训练或架构修改的情况下增强现有冻结语言模型的性能。该方法在推理时应用一个轻量级包装器,将连续的层块循环起来,将其视为常微分方程近似的改进,而不是直接更新。该方法已在不同模型系列中展示了性能提升,包括在 Qwen3 和 Moonlight 等模型上,在 MMLU-Pro、CommonsenseQA 和 OpenBookQA 等基准测试上取得…