研究人员推出 Mnemon,这是一种专为大型语言模型长期上下文设计的新型记忆代理。Mnemon 区分快速、基于判断的任务(系统 1)和慢速、基于推理的任务(系统 2),将前者分配给一个名为 Jev 的决策模型,后者分配给一个 LLM。这种方法使 Mnemon 能够维护并有效利用广泛的对话历史,在使用 GPT-4.1 mini 的 LoCoMo 基准测试中优于其他 14 个系统,并在 LongMemEval-S 上取得顶级结果。 AI
影响 这项研究可能带来更强大的 LLM 助手,能够有效回忆和利用非常长的对话信息。
排序理由 该条目是一篇研究论文,详细介绍了 LLM 记忆的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
在 arXiv cs.IR (Information Retrieval) 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →