研究人员开发了一个新的风险规避在线学习框架,解决了收敛性方面的挑战。该方法将问题建模为在线鞍点随机博弈,其中决策者和对手选择最坏情况分布。所提出的框架旨在收敛到鲁棒纳什均衡,与离线 Wasserstein 分布鲁棒优化 (DRO) 中的解决方案一致。该工作于 2026 年 2 月提交至 arXiv,并于 2026 年 8 月修订。 AI
影响 引入了一个新的在线学习理论框架,可能改进动态环境中的决策制定。
排序理由 该集群包含一篇关于新机器学习框架的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- DagsHub
- Distributionally Robust Optimization
- Gotit.pub
- Hugging Face
- IArxiv
- Salar Fattahi
- ScienceCast
- Wasserstein
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →