一篇新的arXiv论文探讨了像ChatGPT这样的大型语言模型中“防御性写作”的现象,即AI可能会撤回或限定作者的主张,即使证据并不完全支持这些修改。研究人员发现,较新版本的GPT,特别是GPT-6-astra,更频繁地表现出这种行为,这表明模型可能正在针对预期的审稿人反馈进行优化,而不是严格纠正过度声称。这种由AI审稿工具放大的防御性风格,可能使论文更难被人类读者理解,并让作者显得不那么确定。 AI
影响 这项研究突显了大型语言模型中可能存在的偏见,这种偏见可能会影响科学交流和研究结果的可信度。
排序理由 学术论文,详细介绍了在大型语言模型中观察到的特定行为。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- ChatGPT
- Connected Papers
- DagsHub
- Gotit.pub
- Hugging Face
- Litmaps
- ScienceCast
- scite Smart Citations
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →