PulseAugur
中
实时 11:58:13
实体 Semantic IDs

Semantic IDs

PulseAugur coverage of Semantic IDs — every cluster mentioning Semantic IDs across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
14
90 天内 14
发布 · 30天
0
90 天内 0
论文 · 30天
13
90 天内 13
层级分布 · 90 天
主题
关系
情绪 · 30 天

3 天有情绪数据

最近 · 第 1/1 页 · 共 16 条
  1. TOOL · CL_282196 ·

    SPRIG 集成语义ID和知识图谱路径以实现高效生成推荐

    研究人员推出了一种新颖的生成推荐系统SPRIG,该系统集成了内容派生的语义ID(SID)和知识图谱(KG)路径推理。该方法旨在将基于KG的方法的关系基础与基于SID的模型参数效率和泛化能力相结合。SPRIG将物品表示为KG路径内的离散、内容派生的标记,与现有的顺序语言模型和KG增强推荐器相比,其参数更少、计算成本更低,表现出有竞争力。

  2. TOOL · CL_273623 ·

    新框架利用丢弃的量化数据增强生成式检索

    研究人员开发了一个名为残差轨迹蒸馏(ResTD)的新框架,以改进生成式检索系统。该方法旨在利用残差量化过程中通常在标准检索训练中被丢弃的信息。通过蒸馏这些丢弃的信息,ResTD 增强了检索过程,并在多语言电子商务检索任务中显示出持续的改进。该框架也适用于生成式推荐系统。

  3. RESEARCH · CL_267236 ·

    新研究通过上下文优化和高效推理解决生成式推荐问题

    近期研究探索了生成式推荐系统的先进技术,重点在于提高效率和准确性。论文介绍了诸如上下文充分性边界(Context-Sufficiency Frontier)等方法,以优化所提供上下文的相关性,超越了单纯增加数据量的方法。其他研究提出了新颖的推理过程,如ReSolve,它通过复用候选推理来降低计算成本和token使用量。此外,FineSID和SpeakGR等新框架旨在增强语义标识符学习,并在生成式检索模型中保留语言生成能力,以应对稀疏梯…

  4. RESEARCH · CL_242929 ·

    新算法增强了用于生成检索的语义ID · 跟踪2个来源

    研究人员开发了一种新的语义ID生成算法,该算法通过保留原始嵌入空间的结构来改进现有方法。这种方法利用自下而上的聚类来维护局部结构,从而提高语义ID的质量及其在下游生成检索任务中的有效性。该算法旨在确保生成的标识符既是唯一的,又能为各种应用捕获有价值的语义信息。

  5. RESEARCH · CL_228908 ·

    CHAP框架通过分层对齐增强个性化生成检索

    研究人员推出了一种新颖的个性化生成检索框架CHAP,该框架解决了当前系统的局限性。CHAP利用分层语义对齐模块,跨多个粒度更好地匹配动态查询意图与静态项目表示。它还结合了用户行为建模和残差级联生成机制,以提高推理速度并减少信息丢失。在公共和专有数据集上的实验,包括在线A/B测试,都证明了CHAP的有效性和实际价值。

  6. RESEARCH · CL_215728 ·

    新AI方法通过优化物品分词来增强生成式推荐系统 · 追踪6个来源

    研究人员开发了多种优化物品分词以改进生成式推荐系统的新方法。其中一种方法Tlow使用基于流的模型将语义嵌入转换为标准正态分布,从而实现独立分词,并将微信等平台的用户点击率提高了10%以上。另一种方法DASO通过优化基于难度的奖励来解决基于语义ID的生成中的挑战,在多个基准测试中表现优于现有的GRPO方法。此外,一种动态单层语义码本方法降低了自回归解码成本并提高了检索指标,在在线A/B测试中主要消费指标提高了0.792%。另一种技术语义…

  7. RESEARCH · CL_151624 ·

    RecGPT-V3 通过有状态记忆和混合推理增强淘宝推荐 · 跟踪 2 个来源

    RecGPT-V3 是淘宝推出的新型推荐系统,通过引入有状态行为建模、混合模态方法和高效推理,解决了基于大语言模型的推荐挑战。该系统利用记忆中心(Memory Hub)来浓缩用户历史记录,将计算量减少了 55% 以上。它还采用了混合模态基础模型(Hybrid-modal Foundation Model),该模型联合推理文本标签和语义 ID,以实现更好的商品关联。这一新版本已部署在淘宝的“猜你喜欢”信息流中,在提高用户参与度和商业指标…

  8. RESEARCH · CL_139329 ·

    推荐系统从原始ID演进到语义规划

    一篇研究论文探讨了推荐系统的演进,详细介绍了它们如何从使用原始ID转向整合语义ID以更丰富地利用信息。该论文认为,这种演进正朝着“语义规划”发展,即系统在选择特定项目之前预测一个语义目标。这一进步可能需要改变模型设计、评估方法以及用户、平台和提供商之间的目标协调。

  9. RESEARCH · CL_90857 ·

    新研究致力于将大语言模型集成到生成式推荐系统中 · 跟踪 8 个来源

    几篇新研究论文探讨了生成式推荐系统的进展,重点关注如何更好地将用户行为和物品语义集成到大语言模型(LLMs)中。G2Rec 提出了一种可扩展的框架,该框架将基于图的用户协同参与建模与语义标记化相结合。Token Factory 提供了一种将传统信号转换为“软标记”的方法,以便高效地集成到 LLMs 中,防止提示长度问题。另一项研究调查了 LLMs 在生成式推荐中的记忆行为,并引入了 IIRG 来捕捉更丰富的物品-物品关系。HoloRe…

  10. TOOL · CL_79772 ·

    新框架对长用户序列进行建模以实现视频推荐

    研究人员开发了一个新框架,用于对短视频推荐系统中极长的用户行为序列进行建模。该系统使用内容原生语义ID代替传统的物品ID,以减小嵌入表大小并提高对新内容的泛化能力。此外,一个全局感知压缩Transformer可以压缩用户序列,显著降低内存和计算需求。

  11. RESEARCH · CL_77286 ·

    新研究探索用于生成式推荐的语义ID

    两篇新的arXiv论文探讨了在生成式推荐系统中使用语义ID(SIDs)的用法。第一篇论文介绍了SIDReasoner,一个旨在通过增强SIDs与语言模型的对齐来提高SIDs推理能力的框架。第二篇论文研究了基于SID的生成式推荐的扩展限制,并提出直接使用大型语言模型(LLMs)作为推荐器可以提供更优越的性能和扩展特性。

  12. RESEARCH · CL_65473 ·

    新的编码器提升了 LLM 在语义 ID 上的性能

    研究人员开发了 PrefixMem,这是一种新颖的编码器,旨在提高大型语言模型 (LLM) 在处理语义 ID (SID) 时的性能。与目前将 SID 视为简单标记的现有方法不同,PrefixMem 利用前缀 n-gram 记忆表提供结构化、依赖于上下文的表示。这种方法显著提高了 SID 准确性和检索召回率,尤其是在标准 LLM 难以处理的复杂示例中。

  13. TOOL · CL_58795 ·

    新H2Rec框架融合ID以改进推荐系统

    研究人员开发了一个名为H2Rec的新框架,以改进序列推荐系统。该框架融合了语义ID(SID)和哈希ID(HID),以更好地捕捉多粒度语义和独特的协同信号。H2Rec采用双分支架构和双层对齐策略,以有效地转移知识和建模用户偏好。实验表明,H2Rec的性能优于现有方法,在头部和尾部推荐质量之间取得了更好的平衡。

  14. TOOL · CL_45011 ·

    新的UniSID框架通过端到端SID生成改进广告推荐

    研究人员开发了UniSID,一个用于在生成式推荐系统中生成语义ID(SIDs)的新颖框架,特别适用于广告推荐。这种新方法通过端到端联合优化嵌入和SID,解决了现有方法(如Residual Quantization)的局限性,防止了语义退化和误差累积。UniSID还采用了一种多粒度对比学习策略和一种基于摘要的广告重建机制来捕捉更细粒度的语义。实验表明,在下游广告场景中,与当前最先进的方法相比,UniSID的命中率指标提高了4.62%。

  15. TOOL · CL_20754 ·

    研究人员提出生成式推荐系统新框架

    研究人员开发了一个新框架,用于改进生成式推荐系统的语义ID(SIDs)生成。该方法通过整合深度上下文兴趣挖掘、使用视觉语言模型(Vision-Language Models)的跨模态语义对齐以及一个质量感知强化机制来解决信息和语义退化问题。所提出的系统旨在更有效地保留关键上下文信息并对齐不同模态,在实验中表现优于现有的SID生成方法。

  16. RESEARCH · CL_04663 ·

    Eugene Yan 训练 LLM-推荐混合模型以实现可控、可解释的推荐

    Eugene Yan 开发了一种新颖的推荐系统方法,通过训练一个能够理解自然语言和物品 ID 的混合语言模型。该模型将语义 ID 令牌扩展了语言模型的词汇表,不仅可以根据用户历史记录生成推荐,还可以响应对话提示来引导建议。该系统旨在结合 LLM 的世界知识和传统推荐系统的目录感知能力,提供可控性和推理能力。