Anthropic发布了一项研究,详细介绍了其大型语言模型中新发现的内部机制,该机制的功能类似于草稿板或工作记忆。这个内部工作区似乎能容纳诸如“蜘蛛”这样的概念,模型利用它来构建答案,即使该概念没有在提示或最终输出中明确说明。研究人员通过改变内部概念来证明这一点,这直接改变了模型的答案,表明该机制对模型的推理过程至关重要,并引发了关于AI意识可能性的讨论。 AI
影响 这项发现可能极大地增进我们对LLM推理的理解,并可能为未来的AI架构提供信息,同时也加剧了关于AI意识的辩论。
排序理由 研究论文详细介绍了LLM中的一种新内部机制。
在 Mastodon — sigmoid.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 4 个来源。 我们如何撰写摘要 →