一篇新的arXiv论文探讨了当检索工具不提供相关信息时,被称为“冷冻代理”的大型语言模型如何反应。研究人员发现,一个简单的、未宣布的拒绝信号显著提高了Qwen3和Claude Haiku 4.5等模型的弃权率(针对无法回答的问题),从而大大减少了错误答案。研究还强调,拒绝信号的措辞会影响代理行为,解释比纯粹的标记或软警告更有效。 AI
影响 提高代理弃权率可以带来更可靠的AI系统,这些系统能更好地指示何时缺乏信息。
排序理由 该集群包含一篇发表在arXiv上的研究论文,详细介绍了LLM行为的实验结果。[lever_c_demoted from research: ic=1 ai=1.0]
在 arXiv cs.IR (Information Retrieval) 阅读 →
- arXiv
- BM25
- Claude Haiku 4.5
- Claude Sonnet 5.5
- HotpotQA
- Neocorragg
- Opus 5.5
- Qwen3 32B
- Qwen3_8B
- Search-R1
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →