研究人员开发了RELTA-SGLD,这是一种新颖的驯服方案,旨在稳定具有超线性增长的随机梯度Langevin动力学(SGLD)。该方法使用阈值激活驯服,并采用相对增长原则调整其强度,从而减少对学习漂移不必要的抑制。RELTA-SGLD通过为非凸SGLD提供更好的矩稳定性和平稳精度,优于现有方案,在Fashion-MNIST上表现优于未驯服的SGLD和TUSLA,并与AdamW保持竞争力。 AI
影响 引入了一种更稳定、更准确的非凸随机梯度Langevin学习方法,有望改善各种机器学习任务中的优化。
排序理由 该集群包含一篇详细介绍新算法的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →