PulseAugur
中
实时 08:30:41
实体 reasoning-augmented fine-tuning

reasoning-augmented fine-tuning

PulseAugur coverage of reasoning-augmented fine-tuning — every cluster mentioning reasoning-augmented fine-tuning across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_231495 ·

    新研究探讨大型语言模型拒绝机制和控制向量

    两篇新研究论文深入探讨了让大型语言模型拒绝有害请求的机制。第一篇论文比较了监督微调、推理增强微调和 ORPO 等不同的训练后方法在各种模型上的表现,发现训练方法显著改变了内部拒绝计算。第二篇论文研究了表示控制,揭示了控制向量主要与注意力机制的 OV 电路交互,并且在很大程度上忽略了 QK 电路,有可能在不损失性能的情况下进行显著稀疏化。