PulseAugur
实时 00:52:00
实体 KOR-Bench

KOR-Bench

PulseAugur coverage of KOR-Bench — every cluster mentioning KOR-Bench across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_243420 ·

    研究发现:大型语言模型中期训练数据构成影响性能

    研究人员探索了大型语言模型的中期训练阶段,发现跨不同领域的最佳性能是通过适度的(10%-40%)数据构成而非极端分配来实现的。这种最佳构成在随后的对齐阶段后仍然保持稳健且基本不变,表明中期训练的决策对模型的最终能力有显著影响。研究使用了Qwen3-8B-Base模型和KOR-Bench数据集来分析这些影响。