实体
WritingPrompts
WritingPrompts
PulseAugur coverage of WritingPrompts — every cluster mentioning WritingPrompts across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的基准测试显示,AI文本检测器难以处理改写后的人类内容
一个名为ARB的新基准数据集已被开发出来,用于评估AI文本检测器在大型语言模型改写人类创作内容时的有效性。该数据集包括人类撰写的文本、直接的LLM生成文本,以及利用四种开源生成器改写的人类和LLM文本的版本。评估显示,与直接的LLM生成文本相比,检测器在LLM改写的人类文本上的表现明显更差,这表明了当前检测能力存在差距。
-
大型语言模型产生同质化故事,缺乏人类叙事多样性
一篇新发表在arXiv上的研究论文调查了大型语言模型(LLMs)在生成故事时的叙事多样性。研究发现,与人类撰写的故事相比,LLM生成的叙事彼此之间相似度显著更高。这种同质性在前沿模型中尤为突出,这些模型倾向于收敛于一种通用的叙事风格。研究还表明,像负面提示和温度缩放等常用方法在提高LLM输出多样性方面效果不佳。