PulseAugur
实时 07:58:20
实体 PersonaMem-v2

PersonaMem-v2

PulseAugur coverage of PersonaMem-v2 — every cluster mentioning PersonaMem-v2 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_228704 ·

    新的SearchWiki框架学习导航知识维基以进行主动信息检索

    研究人员开发了SearchWiki,一个旨在将语料库合成为结构化、可导航知识维基的框架。该系统训练了一个名为WikiResearcher-9B的智能体,通过多轮工具使用主动搜寻信息,并将知识组织在文档概述、跨文档主题页面和页面级来源记录中。在各种基准测试上的评估表明,WikiResearcher-9B(一个经过RL微调的Qwen 9B模型)的性能显著优于基线模型,并能媲美或超越更大的外部模型,这凸显了与扁平检索方法相比,通过结构化语料…

  2. TOOL · CL_141533 ·

    新的EYT-Bench评估LLM对话,揭示意图追踪的差距

    一个名为EYT-Bench的新基准已被开发出来,用于评估大型语言模型(LLM)的多轮对话能力,重点关注角色一致性、意图追踪和目标完成。该基准采用了解耦的设计,包括用户模拟器、目标模型和LLM评判,并从人工策划的语料库中提取角色以最小化偏见。初步评估显示,虽然当前模型在主观对话方面表现相似,但在客观意图追踪方面存在显著差异。研究还强调,推理能力可以改善客观追踪,角色格式会影响性能,并且大多数模型表现出预热效应,其中GPT-5.5是一个显著的例外。