一项涉及360轮AI小说续写测试的近期实验揭示了九种不同模型的三种主要失败模式。这些失败包括模型从头开始重启叙事、陷入自身生成文本的重复循环,或将情节倒回到早期节点。研究发现,即使是Gemini-3.1 Pro和GPT-5.6 Terra等先进模型也表现出这些问题,这表明表面上的文本模仿与长程叙事连贯性之间存在脱节。DeepSeek V4 Flash和V4 Pro等模型表现更强,前者在奇幻史诗方面表现出色,后者在宫斗小说方面表现突出,这表明模型性能取决于类型。 AI
影响 凸显了当前大型语言模型在长篇创意写作方面的局限性,表明未来模型需要更好的上下文管理和连贯性。
排序理由 该条目详细介绍了研究实验及其对AI模型能力的研究结果。[lever_c_demoted from research: ic=1 ai=1.0]
- DeepSeek V4 Flash
- DeepSeek V4 Pro
- Gemini-3.1 Pro
- GLM 5.2
- GPT-5.6 Terra
- Grok 4.5
- Kimi K2.6
- The Legend of Zhen Huan
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →