研究人员开发了一种名为DEGR(双重探索驱动生成重排)的新颖方法,以改进推荐系统,特别是在上游供应质量较低的情况下。DEGR采用混合监督强化学习方法,由一个探索性奖励模型指导,该模型动态平衡即时用户价值与未来发现的潜力。这种自适应策略旨在通过充当不同用户请求之间的上下文桥梁来提高用户参与度和转化率。在JD电子商务推荐系统上的实验表明,DEGR优于现有方法,在UCTR和PV指标上取得了显著的改进。 AI
影响 通过平衡即时价值与探索潜力来增强推荐系统的有效性,有可能提高用户参与度和转化率。
排序理由 关于推荐系统新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
在 arXiv cs.IR (Information Retrieval) 阅读 →
- alphaXiv
- arXiv
- CatalyzeX Code Finder for Papers
- CORE Recommender
- DagsHub
- Gotit.pub
- Hugging Face
- Influence Flower
- JD E-commerce recommendation system
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →