PulseAugur
实时 09:54:55
English(EN) The Range Shrinks, the Threat Remains: Re-evaluating LLM Package Hallucinations on the 2026 Frontier-Model Cohort

LLM会幻觉出不存在的软件包,带来供应链风险 · 跟踪到1个来源

一项新研究重新评估了大语言模型(LLM)生成不存在的软件包名称的倾向,这是一种被称为“slopsquatting”的漏洞。研究人员测试了五款在2025年10月至2026年3月期间发布的、具备代码能力的模型,发现总体幻觉率在4.62%到6.10%之间。虽然这个范围比以往的发现显著缩小,但威胁依然存在,有53个相同的、与模型无关的幻觉软件包名称尽管存在现有防御措施,但仍可在PyPI和npm上注册。研究还注意到Python与JavaScript幻觉之间的不对称性,以及DeepSeek V3.2和GPT-5.4-mini之间的相似性,这表明它们可能共享训练数据。 AI

影响 识别出多个前沿LLM中持续存在的供应链攻击面,需要改进针对软件包名称幻觉的防御措施。

排序理由 该集群包含一篇详细介绍LLM行为研究结果的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.LG 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

LLM会幻觉出不存在的软件包,带来供应链风险 · 跟踪到1个来源

报道来源 [1]

  1. arXiv cs.LG TIER_1 English(EN) · Aleksandr Churilov (Independent Researcher) ·

    范围缩小,威胁犹存:重新评估2026前沿模型队列上的LLM包幻觉

    arXiv:2605.17062v3 Announce Type: replace-cross Abstract: Spracklen et al. (USENIX Security '25) showed that code-generating large language models hallucinate package names that do not exist on PyPI or npm at rates ranging from 5.2% on commercial models to 21.7% on open-source mo…