PulseAugur
中
实时 07:31:09
实体 Hoffman et al. (2022)

Hoffman et al. (2022)

PulseAugur coverage of Hoffman et al. (2022) — every cluster mentioning Hoffman et al. (2022) across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_273436 ·

    研究发现:AI生成的文本会损害语言模型的预训练

    arXiv上的一篇新研究论文探讨了AI生成的文本对语言模型预训练的影响。研究发现,虽然为数据匮乏的模型添加AI生成的Token最初可以降低在人类文本上的损失,但随着更多AI文本的加入,这种好处会迅速转变为损害。对于在更大数据集上训练的模型,AI Token会立即增加损失。研究人员提出了一个新的缩放定律,该定律同时考虑了AI文本的益处和损害,并提出在目标是人类文本时过滤AI文本是有益的,同时建议为人类文本和AI生成的文本分别报告验证损失。