一位Reddit用户报告称,包括Claude Fable、Gemini和ChatGPT在内的多个大型语言模型,在被要求识别古巴航空运营的一架Il-96飞机时,都会持续出现幻觉。尽管网上有现成的图片和信息,但这些模型未能正确识别飞机和航空公司,而是提供了虚构的答案。该用户对这种失败表示惊讶,并将其与其他已知的LLM推理错误相提并论。 AI
影响 凸显了大型语言模型中持续存在的幻觉问题,即使是在常识性任务中。
排序理由 Reddit上用户生成的内容讨论大型语言模型的失败,而非主要来源发布或重大行业事件。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →