PulseAugur
中
实时 01:28:40
实体 Semantic ID

Semantic ID

PulseAugur coverage of Semantic ID — every cluster mentioning Semantic ID across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 13
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 12
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 15 条
  1. TOOL · CL_229659 ·

    新的HF-SID方法增强了基于位置服务的生成检索

    研究人员推出了一种新方法HF-SID,用于在基于位置服务的生成检索中生成语义ID(SID)。现有的SID难以保留对准确检索至关重要的细粒度细节,例如地理坐标的连续性、数值属性的变化尺度以及层级归属。HF-SID通过将坐标转换为连续的3D笛卡尔形式,并将数值编码为单个单元,并辅以具有类型感知嵌入的Geo-CPT和Num-CPT来解决这些限制。基于结构的对比学习目标进一步优化了这些表示,从而实现了3个标记的SID,且没有额外的解码成本。

  2. TOOL · CL_223183 ·

    新方法改进了语言模型词汇扩展在推荐任务中的应用

    研究人员发现,在为生成式推荐等领域特定任务扩展语言模型(LM)词汇时存在一个显著瓶颈。使用现有嵌入的平均值初始化新词元(token)的标准方法会导致区分度崩溃,而微调难以恢复。一种名为“接地初始化”(GTI)的新方法提出,在微调之前将新词元映射到预训练嵌入空间中具有语义意义的独特位置。与平均初始化和其他适应方法相比,这个轻量级的接地阶段在多个生成式推荐基准测试中表现出更优越的性能,表明初始化质量对于有效的词汇扩展至关重要。

  3. RESEARCH · CL_215728 ·

    新AI方法通过优化物品分词来增强生成式推荐系统 · 追踪6个来源

    研究人员开发了多种优化物品分词以改进生成式推荐系统的新方法。其中一种方法Tlow使用基于流的模型将语义嵌入转换为标准正态分布,从而实现独立分词,并将微信等平台的用户点击率提高了10%以上。另一种方法DASO通过优化基于难度的奖励来解决基于语义ID的生成中的挑战,在多个基准测试中表现优于现有的GRPO方法。此外,一种动态单层语义码本方法降低了自回归解码成本并提高了检索指标,在在线A/B测试中主要消费指标提高了0.792%。另一种技术语义…

  4. RESEARCH · CL_215734 ·

    语义化产品ID提升电商搜索与排名 · 跟踪2个来源

    研究人员开发了一个层级化的语义ID("sid")系统,以改善多商家电商环境中的产品发现和搜索。该系统从产品内容嵌入中学习而来,创建了一个统一的产品层级结构,支持个性化排名和查询重构。评估表明,".sid"层级结构提高了线下相关性和线上参与度,从而为消费者带来更好的产品曝光和更少的搜索精力。

  5. RESEARCH · CL_208188 ·

    新的诊断工具SIDScope评估生成式推荐接口

    研究人员推出SIDScope,一个用于评估生成式推荐系统中语义ID(SID)接口一致性和结构的诊断资源。该工具分析物品到代码的伪影,验证来源,并分析来自Amazon和Yelp的各种数据集的映射结构。SIDScope的发现表明,接口健康是多方面的,前缀对齐是候选曝光的关键因素,并且有效的目标路径可以存在而无需唯一标识目标物品。该资源还强调了在映射修复后重新使用生成器时需要单独进行检查。

  6. RESEARCH · CL_205655 ·

    新的强化学习方法提升生成式推荐系统 · 跟踪到2个来源

    两篇新研究论文SAPO和HCGRec介绍了改进生成式推荐系统的新型强化学习技术。这些方法通过更有效地为单个推理步骤分配信用,或在模型难以找到正确项目时提供有针对性的提示,来解决大型目录推荐中稀疏奖励的挑战。两种方法都旨在稳定训练并提高性能,SAPO侧重于步进对齐策略优化,HCGRec采用提示条件生成。

  7. RESEARCH · CL_192995 ·

    新研究应对生成式推荐挑战,提高公平性和准确性

    多篇研究论文正在探索生成式推荐系统的进展,重点是提高准确性和公平性。EchoRec 提出了一种跨多个时间范围对齐偏好的方法,以实现更好的生成式推荐。FSGR 解决了基于语义 ID 的推荐中的 token 频率偏差,以确保更公平的物品曝光。DiffGRM 采用基于扩散的方法,更鲁棒且并行地生成物品 ID,提高了推荐准确性。DTAMLP 提出了一种用于基于会话的推荐的去噪和时间感知 MLP,识别并减轻意外点击产生的零星噪声。HCGRec …

  8. RESEARCH · CL_191482 ·

    音频嵌入模型在音乐推荐系统中的分析

    一篇新的研究论文分析了各种音频嵌入模型在音乐推荐系统中的有效性,特别关注生成式方法。该研究系统地评估了六种音频编码器在基于内容、基于序列和基于 Semantic-ID 的生成式推荐系统中的表现。研究结果表明,音频-文本对齐和音乐域表示直接使用时效果最佳,而基于交互的序列训练可以缩小编码器之间的性能差距。研究还表明,增加 Semantic-ID 容量并不能持续提升生成式系统,反而可能导致不稳定。

  9. TOOL · CL_186948 ·

    Gryphon-v2统一模型使Yandex Music用户增长1.41%

    研究人员开发了Gryphon-v2,这是一种用于端到端推荐系统的统一生成和排序架构。该新模型通过一次性编码用户历史记录,然后在单个框架内生成和排序候选对象,从而简化了复杂的多级级联。通过从高容量教师排序器中蒸馏偏好,Gryphon-v2在Yandex Music的A/B测试中实现了与现有级联相当的服务延迟,同时使活跃用户增加了1.41%。

  10. RESEARCH · CL_180200 ·

    GRACE系统通过生成式推荐器加速实时广告检索

    一篇新的研究论文介绍GRACE,一个旨在加速生成式推荐器以进行实时广告检索的系统。GRACE通过实现生成式目标匹配(GTM)来改进广告定位,并优化编码器-解码器Transformer以降低延迟和成本,从而解决了资格和计算方面的挑战。该系统在NVIDIA GH200硬件上实现了显著的性能提升,将交叉注意力延迟降低了高达68倍,并将整体解码器延迟降低了11.1倍。

  11. RESEARCH · CL_166828 ·

    新研究通过效率和推理能力增强了基于LLM的推荐系统

    研究人员正在开发新的方法,通过利用大型语言模型(LLM)和优化计算效率来改进推荐系统。WhisperRec专注于潜在推理以减少推理开销,而ROCS和CCFormer分别提出了面向请求的计算共享和高效的跨字段交互。HiLaR和Feedback-Grounded Policy Discovery等其他方法分别旨在通过分层潜在推理和基于反馈的策略发现来增强基于LLM的推荐。像Google Discover这样的系统中的异构排名也正在通过自适…

  12. TOOL · CL_160682 ·

    研究发现生成式推荐模型难以处理新商品

    研究人员探讨了基于语义ID(SID)的生成式推荐系统的局限性,特别是它们处理“冷门商品”(即具有未见过语义标记的新商品)的能力。时间分析显示,虽然这些模型有时可以根据观察到的标记和前缀预测未来的商品,但在遇到全新的原子标记或支持较弱的SID路径时会失败。该研究将SID生成视为一个分层的语义分桶过程,表明当前方法是组合式的但并非完全开放式的,这为未来在更独立的SID空间和动态文本语境中的研究指明了方向。

  13. TOOL · CL_129578 ·

    新框架 ChronoSID 通过整合时间数据增强推荐系统

    研究人员开发了 ChronoSID,一个通过整合时间信息来增强生成推荐系统的新框架。与先前将用户交互历史视为静态序列的方法不同,ChronoSID 考虑了交互之间经过的时间。这通过用于表示学习的时间感知字段感知掩码自动编码,以及将时间间隔离散化为与物品 ID 交错的标记来实现。在亚马逊评论数据上的实验表明,ChronoSID 在提高推荐准确性方面是有效的,尤其是在用户偏好更可能发生变化的较长时间间隔场景中。

  14. RESEARCH · CL_104627 ·

    新的令牌化方法提升大型推荐模型 · 2篇论文

    两篇研究论文介绍了通过将各种信号转换为高效令牌表示来增强大型推荐模型的新颖方法。TokenMinds 专注于预训练离散用户令牌和密集嵌入以进行用户理解,并在 YouTube 上展示了其有效性。Token Factory 提出了一个将传统信号转换为“软令牌”的框架,能够高效地集成到基于 Transformer 的推荐模型中,并减少提示长度和计算开销。

  15. TOOL · CL_81958 ·

    新工具SIDInspector诊断用于AI推荐的语义ID分词器

    研究人员开发了SIDInspector,一种用于评估语义ID(SID)分词器的新诊断工具。这些分词器越来越多地用于生成式推荐系统,其中它们的项到代码映射作为序列生成器的地址空间。SIDInspector旨在在潜在问题影响下游模型训练之前识别覆盖范围差距、别名和弱前缀等问题。该工具已应用于多个分词器构件线,揭示了其结构和对齐属性的见解。