PulseAugur
实时 19:29:55
实体 Prasanna Mayilvahanan

Prasanna Mayilvahanan

PulseAugur coverage of Prasanna Mayilvahanan — every cluster mentioning Prasanna Mayilvahanan across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_44741 ·

    预训练数据决定LLM的缩放定律,研究发现

    研究人员发现,预训练数据是大型语言模型中损失到损失缩放定律的主要决定因素。他们的实验表明,模型大小、优化超参数,甚至Transformer和状态空间模型之间的架构差异等因素对这些缩放趋势的影响有限。研究结果表明,精心策划的预训练数据集对于优化下游性能至关重要,而其他模型配置可以针对训练效率进行调整。