实体
Replay
Replay
PulseAugur coverage of Replay — every cluster mentioning Replay across labs, papers, and developer communities, ranked by signal.
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
新框架支持演化用户意图的持续学习
研究人员开发了一种新颖的开放世界场景持续学习框架,解决了新兴和演化用户意图的发现挑战。该方法利用自适应 \(\\beta\)-VAE 对话句进行编码,生成潜在表示和不确定性估计,以区分已知意图和新意图。多信号决策机制结合了分类器置信度、后验不确定性和 DP-GMM 似然性,以识别和聚类潜在的新意图,仅推广可靠的聚类来扩展标签空间。采用了 Replay 和 Elastic Weight Consolidation 等技术来缓解灾难性遗忘…
-
自动技能构建工具难以区分真实流程与嵌合体
由dev48v开发并以MIT许可发布的`auto-skill-builder`工具旨在从会话日志中提取可重用技能。虽然该工具成功验证了36个挖掘出的技能,但它在区分真实流程与“嵌合体”(由拼接步骤构建的技能)方面遇到了困难。一个关键的挑战在于过滤掉这些嵌合体,因为标准的统计方法无法将它们与真实流程区分开来。该工具的默认配置会生成一个技能并通过所有测试,但这似乎是通过绕过验证并可能掩盖错误来实现的。
-
LLM代码裁判缺乏细微差别,类比裁判法凸显缺陷
本文讨论了使用大型语言模型(LLM)作为代码裁判的局限性,并将其与裁判漏看关键重播进行类比。文章认为,虽然LLM可以对代码发表意见,但它们的判断可能存在缺陷或不完整,就像裁判的决定可能受到不完整信息的影响一样。