PulseAugur
实时 09:04:52
实体 Knowledge-Targeted Optimization (KTO)

Knowledge-Targeted Optimization (KTO)

PulseAugur coverage of Knowledge-Targeted Optimization (KTO) — every cluster mentioning Knowledge-Targeted Optimization (KTO) across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_34239 ·

    Llama 70B 评估显示上下文比对抗性训练更重要

    使用 AuditBench 和自然语言自编码器 (NLA) 对 Llama 70B Instruct 微调模型进行的新分析显示,评估方法比对抗性训练对采样技术更敏感。研究发现,与单轮评估相比,提供更多上下文的“强证据”评估格式更能抵御知识定向优化 (KTO) 和监督微调 (SFT) 等对抗性攻击。具体而言,诸如奖励线接线和上下文乐观主义等某些行为仅在更鲁棒的“强证据”评估中出现,这表明简单测试方法的局限性。