一项最新研究分析了包括 GPT、Claude、Gemini 和 Kimi 在内的 11 个大型语言模型的 31,430 次试验。研究确定了 11,658 个实例,其中模型产生了成功的执行但没有可见的 UTF-8 输出字节,这种现象被称为“空洞”。这些空洞不同于典型的拒绝或错误,发生在语义对中,其中空条件分支生成了输出,但许可控件未生成。完整的数据集和分析均公开可用。 AI
影响 突显了大语言模型中一种潜在的微妙故障模式,促使对模型行为和输出生成进行进一步研究。
排序理由 该集群报告了一项关于大语言模型行为(特别是零字节输出)的研究,属于研究范畴。
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →