一项新近发表在arXiv上的研究表明,大型语言模型(LLMs)在战略对话中表现出脆弱的时间适应性,难以应对实时截止日期。研究人员发现,提供明确的剩余时间更新显著提高了GPT-5.1-chat-latest的交易完成率,从4%提升至32%。研究还表明,定性紧迫性提示比数字倒计时更有效,并且模型的表现高度依赖于时间限制的呈现方式。 AI
影响 凸显了大型语言模型战略推理的一个关键局限性,表明需要改进以适应现实世界中对时间敏感的应用。
排序理由 发表在arXiv上的研究论文,详细介绍了大型语言模型的能力。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →