研究人员开发了一种从大型语言模型(LLMs)中提取和测试文学质量隐含理论的方法。在一项使用DeepSeek的研究中,该模型在将文本分类为六个质量等级方面达到了79.3%的准确率,显示出其偏好意图、技巧、深度和独特的语气,而非仅仅正确性。进一步的实验表明,结构退化和语气简化对感知质量的负面影响比词汇简化更大。与Qwen QwQ的探索性比较表明,质量判断存在相似的模式。 AI
影响 为了解大型语言模型如何感知和评估创意文本,可能改进自动写作反馈和计算美学。
排序理由 该集群描述了一篇发表在arXiv上的研究论文,详细介绍了一种评估大型语言模型推理的新方法及其在文学质量方面的应用。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- Connected Papers
- DagsHub
- DeepSeek
- Gotit.pub
- Hugging Face
- Litmaps
- ScienceCast
- scite Smart Citations
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →